AIモデルとプラットフォーム

アンソロピック、Claude デスクトップ コントロールを Mac に導入

mm
Unite.AI を Google の優先ソースに追加

アンソロピックは、Claude の機能を拡張し、macOS で直接デスクトップ コントロールを実現し、Slack やカレンダー アプリなどの標準的な統合が利用できない場合に、AI がクリック、タイプ、ナビゲート アプリケーションを実行できるようにしました。

この機能は、現在、Claude Cowork と Claude Code の Claude Pro サブスクライバー ($20/月) と Claude Max サブスクライバー ($100/月) 向けに研究プレビューとして利用可能です。現在、macOS 限定です。

デスクトップ コントロールのしくみ

Claude はデフォルトでデスクトップ コントロールに切り替わりません。システムは、既存のアプリ統合 — 接続されたカレンダー、Slack、または他のサポート対象ツール — を使用してタスクを完了しようとします。統合が利用できない場合のみ、Claude はマウスとキーボードを制御してタスクを直接完了します。

ユーザーは、Claude が制御を許可される各アプリケーションを明示的に承認する必要があり、セッション中の任意の時点で Claude を停止できます。設計は、アンソロピックが研究プレビュー段階で人間をループに保持することを優先していることを反映しています。

デスクトップ コントロールとともに、アンソロピックは Dispatch — ユーザーが iPhone で Claude にタスクを割り当て、デスクトップで完了した作業に戻ることを可能にするコンパニオン機能 — をリリースしました。モバイル アプリはアクティブな Cowork セッションに接続され、すべての処理はローカルで Mac 上で実行されます。

Vercept アクイジションがテクノロジーを裏付ける

この機能は、アンソロピックが 2026 年 2 月に買収したシアトルを拠点とするスタートアップ Vercept AI のテクノロジーに基づいています。Vercept は、2024 年 11 月に Allen Institute for AI の元研究者である Kiana Ehsani、Luca Weihs、Ross Girshick、Matt Deitke が設立しました。Vercept は、取引が成立する前に、Fifty Years が主導するシードラウンドで 1,600 万ドルを調達しました。エンジェル投資家には、元 Google (GOOGL ) CEO のエリック・シュミット、Google DeepMind のチーフサイエンティストのジェフ・ディーン、Cruise の創設者であるカイル・ボグト、Dropbox (DBX ) の共同創設者であるアラシュ・フェルドシが含まれました。

Vercept の製品である Vy は、クラウドベースのコンピューター制御エージェントとして Mac で動作していました。アンソロピックは、Vercept ユーザーに 30 日間の通知を提供した後、2026 年 3 月 25 日に Vy を終了し、チームを吸収しました。共同創設者の Ehsani は、「チームはアンソロピックに参加してから 4 週間以内に最初の製品をリリースしました」と述べ、Dispatch がその成果であると指摘しました。

Claude のコンピューター使用のパフォーマンスは、アンソロピックが 2024 年後半にこの機能を初めて導入して以来、著しく改善されています。OSWorld Verified — コンピューターを操作する AI モデルに対する標準的な評価 — で、Claude Sonnet モデルは初期リリース時に 15% 未満のスコアでした。Claude Sonnet 4.6 では、この数字は 72.5% に達し、約 70〜75% の人間ベースラインに近づいています。Opus 4.6 では、同じテストで 72.7% のスコアを達成しています。

セキュリティと信頼性は未解決の疑問のまま

デスクトップ コントロールは、ブラウザベースまたは API 統合では存在しないリスクを生み出します。Claude がライブ デスクトップを操作すると、ユーザーが承認したアプリケーション、開いているファイル、および画面上の任意のデータにアクセスできます。アンソロピックの以前のコンピューター使用に関する研究では、画面上のコンテンツに悪意のある命令が埋め込まれている場合に、ユーザーの意図を上書きできる「プロンプトインジェクション」を主な攻撃面として特定しました。Sonnet 4.6 では、以前のバージョンよりもこの点で改善が見られます。

信頼性も懸念事項です。Claude の以前のコンピューター使用アーキテクチャは、連続したビデオ フィードではなく、連続したスクリーンショットを処理していたため、短期間のアクションや通知をミスすることがありました。Vercept チームのアプローチがこの問題を解決するかどうかは、まだ公開されていません。

OpenAI の macOS ブラウザベースのエージェントや同様の製品は、デスクトップ オートメーションがソフトウェア インターフェイスの変更で簡単に壊れるため、採用の摩擦に直面しています。アンソロピックは、デスクトップ コントロールを標準統合に失敗した場合のフォールバック位置に制限することで、エラーの表面を減らしていますが、機能のスコープも完全に自律的なデスクトップ エージェントに比べて狭めています。

より大きな疑問は、ビジネス オートメーション用の AI エージェントが、制御されたデモから実際の生産環境に信頼性を持って移行できるかどうかです。Claude のコンピューター使用ベンチマーク スコアは、約 16 か月で 5 倍に改善されています。これは、重要なトラジェクトリです。しかし、カーセッド タスクでのベンチマークの改善は、必ずしも生産環境でのパフォーマンスを予測するものではありません — 予期せぬダイアログ、APPLICATION の更新、および状態の変更は、評価では完全に捉えられません。アンソロピックがセキュリティ開示をどのように扱うかは、デスクトップ コントロールが研究プレビューのステータスを超えて実用化できるかどうかの最初の実証となります。

Alex McFarlandは、人工知能の最新の開発を探求するAIジャーナリスト兼ライターです。彼は、世界中の数多くのAIスタートアップや出版物と共同しています。