AIモデルとプラットフォーム
オープンAIとアンソロピック、モデル開発競争激化のなかで新モデルを発表

オープンAIとアンソロピックは、今日、新しいフラグシップモデルをほぼ同時に発表しました。オープンAIは同時にエンタープライズエージェントプラットフォームも立ち上げました。さらに、パーセプティビティはマルチモデル研究機能を導入しました。今日の発表は、通常1週間で発表されるAI製品の発表数を上回るものでした。
ここに今日の発表内容とその意味について説明します。
アンソロピックのオプス4.6:エージェントチームと100万トークンのウィンドウ
アンソロピックはクラウドオプス4.6を発表しました。これは、同社の最も能力の高いモデルで、2つの重要な機能を備えています。1つの機能は、100万トークンのコンテキストウィンドウで、もう1つの機能は、エージェントチームと呼ばれる新しい機能です。
コンテキストウィンドウは、技術的な成果としてより重要です。100万トークンで、オプス4.6は、約3,000ページのテキストを1つのプロンプトで処理できます。これは、256,000トークンの制限を持つ前身モデルよりも4倍の容量です。128,000トークンの出力サポートと組み合わせて、モデルはコードベース、規制ファイリング、研究コーパスなどの大規模なデータを、チャンキングや要約なしで処理できます。
エージェントチームは、クラウドコードで利用可能で、複数のクラウドインスタンスが共有コードベースで並行して作業できます。単一のエージェントがタスクを順番に実行するのではなく、開発者はフロントエンドの変更を担当するエージェント、テストを担当するエージェント、バックエンドロジックを担当するエージェントなど、複数のエージェントを同時に作業させることができます。
オプス4.6は、適応的な思考機能も導入しました。これにより、モデルは、与えられたプロンプトに対してどれだけの推論努力を投資するかを調整できます。単純な質問には迅速な回答が返され、複雑な問題にはより深い思考が行われます。開発者は、低、 сред、 高、最大の4つのレベルで努力を調整できます。
ベンチマークテストでは、オプス4.6は、Terminal-Bench 2.0のエージェントコーディングで最高スコアを獲得し、Humanity’s Last Examという複雑な推論評価でもトップです。アンソロピックは、GPT-5.2に対して144ポイントのEloアドバンテージを持ち、オプス4.5に対して190ポイントの改善があると主張しています。
APIの価格は、入力トークン1ミリオンあたり5ドル、出力トークン1ミリオンあたり25ドルで、200,000トークンを超えるプロンプトは、10ドル/37.50ドルのプレミアムレートが適用されます。
注目すべきエンタープライズ動きとして、アンソロピックは、マイクロソフトのPowerPointでのクラウドの研究プレビューを発表しました。ここで、モデルは既存のスライドレイアウトとテンプレートを読み取り、プレゼンテーションを生成または編集できますが、ブランドのフォーマットは保持されます。
オープンAIのGPT-5.3-Codex:自分で自分を構築したモデル
アンソロピックの発表の数分後、オープンAIはGPT-5.3-Codexを立ち上げました。これは、同社の最も能力の高いコーディングモデルです。このリリースにより、GPT-5.2-CodexのフロンティアコーディングパフォーマンスとGPT-5.2の推論および専門知識の機能が統合され、25パーセント高速化された単一システムが実現しました。
最も注目すべき主張は、GPT-5.3-Codexが自分で自分を構築したことです。オープンAIのCodexチームは、モデルを開発中に、トレーニング実行のデバッグ、デプロイインフラストラクチャの管理、評価結果の診断に早期バージョンのモデルを使用しました。これは、モデルが自分自身の開発に重要な役割を果たしたことをオープンAIが初めて公に認めたことであり、効率と安全性に関する疑問を提起しています。
GPT-5.3-Codexは、SWE-Bench ProとTerminal-Benchというベンチマークで、業界最高のパフォーマンスを達成しました。これらのベンチマークは、実世界のソフトウェアエンジニアリングタスクを評価します。モデルは、研究、ツールの使用、複雑な実行を伴う長時間のタスクを処理でき、ユーザーはタスク中でもコンテキストを失うことなくモデルとやり取りできます。つまり、同僚と協力するようにモデルとやり取りするのではなく、コマンドを発行するのではなく、コラボレーションするのです。
モデルは、すべてのChatGPT有料プランユーザーがCodexアプリ、CLI、IDE拡張機能、Webインターフェイスを通じて利用できます。APIアクセスは近く提供される予定です。
開発者がAIコードジェネレーターを選択する場合、競争の状況は明確に定義されています。オプス4.6はエージェントの調整と長いコンテキストでの作業で先行していますが、GPT-5.3-Codexは速度と統合された推論を強調しています。両者は、重複するベンチマークで最高の評価を主張しています。CursorやAppleのXcodeなどのツールは両者をサポートしているため、開発者は自由に切り替えることができます。
オープンAIフロンティア:エンタープライズエージェントが独自のプラットフォームを得る
モデル立ち上げと同時に、オープンAIはフロンティアを発表しました。これは、エンタープライズエージェントを構築、デプロイ、管理するためのプラットフォームです。フロンティアは、データベース、CRMシステム、HRプラットフォーム、チケットツール、その他のビジネスアプリケーションに接続し、AIエージェントがそれらをまたいでプロセスを実行できるようにします。
オープンAIは、フロンティアを「エンタープライズのセマンティックレイヤー」と説明しました。ここで、人間の従業員とAIエージェントが同じプラットフォームで共有データアクセスとセキュリティコントロールを共有します。エージェントは、従業員のようなID、共有組織コンテキスト、エンタープライズグレードのパーミッションを持ちます。
プラットフォームはモデル非依存です。企業は、オープンAIのモデルで構築されたエージェントと、Google (GOOGL ) 、Microsoft (MSFT ) 、アンソロピックなどの他のモデルで構築されたエージェントを管理できます。初期の顧客には、Intuit (INTU ) 、State Farm、Thermo Fisher、Uberが含まれます。
フロンティアにより、オープンAIは、SalesforceのAgentforceやServiceNowのAIエージェントなどのエンタープライズプラットフォームと直接競争できるようになりました。違いは、オープンAIがモデルレイヤーから構築しているのに対し、既存の企業は既存のワークフローツールにAIを追加していることです。企業がAIインフラストラクチャをAIプロバイダーから取得するか、ソフトウェアベンダーから取得するかによって、エンタープライズAI競争が2026年に定義されることになります。
パーセプティビティのモデルカウンシル:3つのモデル、1つの答え
パーセプティビティはモデルカウンシルを立ち上げました。これは、同じクエリを3つのモデル(クラウドオプス、GPT、ジェミニ)で同時に実行し、シンセサイザーモデルを使用して出力を1つの答えに統合し、一致と不一致の領域をフラグします。

Image:パーセプティビティ
前提は、単一のモデルがすべてのクエリに対して信頼性の高い最良のモデルであるとは限らないということです。3つのフロンティアモデルが同じ答えに収束する場合、信頼性は高いです。モデルが乖離する場合、ユーザーはさらに調査する必要があります。モデルカウンシルは、Maxサブスクライバー向けに提供され、投資研究、戦略分析、複雑な意思決定に適しています。
この機能は、パーセプティビティが、基礎モデルを構築するのではなく、マルチモデルのオーケストレーションを通じて差別化する戦略を反映しています。フロンティアAIチャットボットのギャップが個々のベンチマークで狭まるにつれて、モデルを組み合わせることが、単一のプロバイダーを選択するよりも価値がある可能性があります。
全ての意味
これらのリリースは、AI競争がモデル能力から製品インフラストラクチャへの移行を示しています。オープンAIとアンソロピックの両者が同じベンチマークで最高の評価を獲得しているため、差別化はモデル上にではなく、モデル上に構築できるものにあります。
パーセプティビティは、モデル戦争がモデルを組み合わせる方法よりも重要ではないことを示唆しています。モデルカウンシルが有用であることが証明されれば、将来はクラウドとGPTのどちらかを選択するのではなく、両者を使用することになる可能性があります。
開発者やエンタープライズがAIスタックを評価する場合、この発表により、決定がより困難になりました。












