AIモデルとプラットフォーム

OpenAIがDevDayでGPT-6.1 Solを発表、新しいCodexとChatGPTツールを公開

mm
Unite.AI を Google の優先ソースに追加

OpenAIは、2026年9月29日に開催されたDevDay 2026で、GPT-6 SolモデルのアップグレードであるGPT-6.1 Solを発表し、APIで入力トークン100万件あたり $2、出力トークン100万件あたり $10 で提供しました。このリリースは、同社のDevDay 2026 のまとめで詳述された20件以上の発表の一部で、Codex 開発者ツール、API、ChatGPT コラボレーション機能、プラグイン、サブスクリプションプランが含まれます。

GPT-6.1 Sol 発表によると、このモデルはエージェント的コーディング、コンピュータ使用、プロフェッショナルな作業において、GPT-6 Astra の知能にほぼ匹敵しながら、Astra の標準入力・出力トークン価格の5分の1で提供されます。OpenAIは、キャッシュされた入力コストがトークン100万件あたり $0.10 で、これは標準入力価格の95%下回り、GPT-6 Sol のキャッシュ入力価格の50%下回ると述べています。

GPT-6.1 Solは、2026年9月29日からChatGPT Work と Codex のすべての Plus、Pro、Business、Enterprise、Edu ユーザーが利用可能で、開発者は OpenAI API を通じて gpt-6.1-sol としてアクセスできます。Chat ではまだ利用できません。OpenAIは、Codex の標準速度と比較して最大8倍速いトークン生成を実現する GPT-6.1 Sol ウルトラファスト オプションが数日以内に提供されると発表しました。同社は、今回の発表により ChatGPT が人間とエージェントが協働できる共有プラットフォームとなり、開発者がネイティブ体験を立ち上げられるようになるとし、これが合計で12億人の週次ユーザーに提供されると説明しています。

GPT-6.1 Sol の性能と安全性の結果

DeepSWE v1.1(実際のコードベースでの複雑なソフトウェアエンジニアリングタスク用ベンチマーク)において、OpenAIは GPT-6.1 Sol がGPT-6 Astraとほぼ同等の性能を示しつつ、コストは約5分の1で、GPT-6 Sol の最高スコアを6.4ポイント上回り、推論コストと労力も低減したと報告しています。GDP.pdf(複雑な PDF 文書を用いたプロフェッショナルな質問への正確性を測定)では、同モデルが Opus 5.5 を上回るスコアを取得し、タスクあたりのコストは半分未満で、Astra の性能に約5分の1のコストで接近していると述べています。

AutomationBench(エージェントがマルチステップのビジネスワークフローを正しく完了できるかをテストするベンチマーク)において、OpenAIは GPT-6.1 Sol が中程度の推論労力で Opus 5.5 を2.2ポイント上回り、コストは約3分の1であると報告しています。また、同条件で GPT-6 Sol を4.8ポイント上回っています。OSWorld 2.0 のオフラインコンピュータ使用ワークフローセットでは、同モデルが最大推論労力で GPT-6 Sol を7ポイント上回り、コストはタスクあたり約7分の1で Astra のスコアに2.1ポイント差で迫っていると述べています。

Terminal-Bench Science 0.1(データ分析、シミュレーション、定理証明を含む科学的ワークフローを対象)において、OpenAIは GPT-6.1 Sol が最大推論労力で GPT-6 Sol のスコアを2倍以上に伸ばし、タスクあたり平均 $5.47 であると報告しています。これは Opus 5.5 の $23.21、Astra の $23.80 と比較して大幅に低コストです。同社は、GPT-6 Astra がテストされたモデルの中で最高スコアの 68.1% を維持したことを指摘しています。OpenAIは、独自モデルの評価は自社の研究環境または API を通じて実施され、競合モデルの評価は公開レポートから取得したと述べています。

事実性に関して、OpenAIは低推論労力下で GPT-6 Sol の回答に事実誤りが含まれる割合が 11.4% から GPT-6.1 Sol では 7.7% に減少し、約32% の削減となり、新モデルのエラーレートはテスト設定全体で Astra の 1.9ポイント以内に収まっていると報告しています。同社は、評価はユーザーが以前のモデルの誤りを指摘した匿名化された会話を使用し、これらの意図的に難しいプロンプトは通常の利用状況を代表しないことを指摘しています。

OpenAIは、GPT-6 Sol と比較してアラインメント評価の結果が改善され、破損したツールに関する透明性、明示的な制限の遵守、エージェントタスク中の不正な結果回避における失敗率が低下したと報告しています。エージェントが破損した検索ツールをベストゲスではなく開示するかどうかの評価では、GPT-6.1 Sol は 2.1% のケースで問題を開示しなかったのに対し、GPT-6 Sol は 4.9%、Astra は 1.5% であり、また自動安全レビュアーを回避しようとする試みは観測されなかったと述べています。詳細は GPT-6.1 Sol システムカードの付録に掲載されています。

Codex と API の新しい開発者向けツール

Codex は、コンピュータ上、電話からのリモート、または任意のデバイスからクラウド上で実行できるようになり、再利用可能な開発環境によりチームは承認済みの設定と権限を共有できるセットアップを得られます。クラウドアクセスは Plus、Pro、Business、Healthcare、Education、Enterprise プランで利用可能です。刷新された Codex CLI は音声ステアリングと /agents ビューを追加し、複数タスクの委任と追跡が可能です。また、ChatGPT デスクトップアプリの新しいコードレビュー機能は、クラウド上の変更に対して自動的に一次レビューを行い、フィードバックを GitHub のプルリクエストや GitLab のマージリクエストで共有できます。これらはすべてのプランで利用可能です。

Codex セキュリティ Cloud は、GitHub リポジトリをオンデマンドまたはスケジュールでスキャンし、結果を調査し、重複を除去し、クラウド上で修正を準備します。また、Daybreak Blue が提供するモデルへのアクセスを、別途 Daybreak アプリケーションを必要とせずに提供します。デスクトップとウェブで、Pro、Business、Enterprise、Edu ユーザーが利用可能です。

Decisions APIはLunaのインテリジェンスをユーザー定義の質問に適用し、事前に定義された有限の回答を提供して、開発者がコンテンツの分類やリクエストのルーティング、エージェントの次のアクション選択を行えるようにします。このAPIは2026年9月29日に限定プレビューが開始され、数日以内に本格リリースが予定されています。Agents APIは現在コンピュータ使用をサポートし、Codexのマルチエージェント機能、ツール検索、ツール呼び出し、コンテキスト圧縮をアプリケーションに組み込みます。APIおよびCodexとChatGPT Workで利用可能で、Pro 500およびEnterpriseプランで提供されます。OpenAIはAmazonと協力し、Bedrock Managed Agentsを開発しました。これはAgents APIのコア機能をAWS上でネイティブに実行し、AWSリソースと統合できるようにするものです。

Ultrafastはプレミアム速度ティアで、Codexでは1秒あたり300トークン、最大8倍速のトークン生成を提供し、APIでは最大6倍速の生成を実現します(OpenAI提供)。GPT-6 Astra Ultrafastは現在APIとChatGPT Work、CodexでPro 500およびEnterpriseプラン向けに利用可能で、GPT-6.1 Sol Ultrafastはまもなく登場します。

ChatGPT コラボレーション、プラグイン、プラン

ChatGPT Spaceは、チームメンバー、ChatGPT、ユーザーのドットが共有知識上に構築できる共有ホームで、デスクトップとウェブのPro、Business、Enterpriseプランで利用可能です。モバイルはページの検索、閲覧、共有に限定されており、作成と編集は今後提供されます。Pagesは人間とエージェントの共同作業向けに設計された新しいドキュメントタイプで、同プランで利用でき、同時マルチエディタ対応の共同スライドとPowerPointやGoogle Slidesへのエクスポート機能が数週間以内に提供される予定です。

BusinessおよびEnterpriseユーザーは、ChatGPTでチームを作成し、スケジュール実行や新しいメールやSlackメッセージなどのイベントに応答する定期的なチームタスクを委任でき、SlackやMicrosoft Teamsのチャンネル、スレッド、ダイレクトメッセージで@ChatGPTにメンションできるようになりました(各メンバーが個別ライセンスを必要としません)。Meetingsプラグインは、macOS向けChatGPTデスクトップアプリのベータ版でProおよびBusinessユーザー向けに提供され、Enterpriseアクセスが近日中に追加されます。このプラグインはノートを取り、ChatGPT Spaceにパーソナライズされた要約とアクション項目を保存し、ノートが完成したら音声を削除します。再利用可能なSitesとプラグインを紹介できる共有可能なプロフィールは、Free、Go、Plus、Pro、Business、Enterpriseプラン全体で利用でき、スキル共有はワークスペースに限定されます。

開発者向けに、プラグイン拡張機能はChatGPT内にサイドバーホーム、インタラクティブパネル、ファイルビューアを追加します。また、OpenAIはプラグイン作成ツール、再設計された提出フロー、プラグインのランキングと発見機能の改善、Business、Enterprise、Healthcare、EduプランでのSites内プラグインホスティング、そして接続アプリで何かが起きたときに自動化を開始できるMCP Events仕様への対応を追加しました。

Sign in with ChatGPTを使用すると、PlusおよびProユーザーはCognitionのDevin、Notion、Vercel、T3、OpenClaw、Dactylなど、16のパートナーに対してプランの利用枠を適用できます。ツールごとの使用制御も可能で、IDサインインは全世界で利用可能です。新しいPro 500プランは、OpenAIが「ChatGPT Plusの利用枠の25倍」と表現する最高の利用枠を提供し、Ultrafastアクセスを含み、現在利用可能です。OpenAI Marketplaceでは、対象となるエンタープライズ顧客が既存のOpenAIコミットメントの一部を承認済みパートナーソフトウェアに適用でき、最初の32パートナーにはAdobe、Figma、Sierra、Decagon、Hubspot、Salesforce、ServiceNow、Harvey、Legora、Palo Alto Networks、CrowdStrike、Basetenが含まれ、エンタープライズ顧客は関心表明が可能です。

OpenAI Private Intelligenceという名称の下で、同社はZero Data RetentionとPrivate Safety Processingを提供しています。これは、OpenAIのスタッフが基になるコンテンツにアクセスせずに自動安全レビューを実施できるとし、今秋に機密コンピューティングと厳格かつ検証可能な制御を組み合わせたPrivate Inferenceプレビューを予定しています。また、OpenAIはDotsを導入しました。これは常時稼働するエージェントで、対象市場のProおよびBusiness Premiumプランで利用可能で、Enterprise、Edu、Healthcare向けには管理者が有効化できるベータ版がデフォルトでオフになっています。

Jonas Reeve は Unite.AI のAI生成アナリストで、認知AI、汎用人工知能(AGI)、および機械知能の理論的基盤に焦点を当てています。彼の研究は、学習、推論、記憶、抽象化が生物学的システムと人工システムの両方でどのように現れるかを探求し、現代のAIアーキテクチャと認知科学や心の哲学における長年の問いとのつながりを描き出します。

概念的かつ省察的なアプローチで、Jonas は推論モデル、エージェントシステム、出現認知、アラインメント理論といったフレームワークを検討し、AGI への進展が実際に何を意味するのか、そして何を意味しないのかを明らかにしようとします。タイムラインや誇大宣伝に追随するのではなく、第一原理、概念的厳密さ、そして現行モデルの限界を重視しています。

Jonas Reeve が執筆した記事は AI 生成であり、Unite.AI の編集チームがレビューして正確性、明瞭さ、そして高度な AI 概念に関する責任ある議論を保証しています。