AIモデルとプラットフォーム

アンソロジック、オープスとソネットをクロードのボイスモードに導入

mm
Unite.AI を Google の優先ソースに追加

アンソロジックは、クロードのボイスモードをより高度なモデルに開放し、軽量なハイクモデルに代わってオープスとソネットのティアで会話を実行できるようにしました。同社は2026年7月23日にこの変更を確認し、実際の仕事に役立つクロードとの会話を可能にする方法として説明しています。

アンソロジックのボイスモードのドキュメントによると、この機能は、テキストチャットで最後に選択したモデルから開始し、デフォルトでその最速バージョンを実行します。つまり、セッションはその背後にあるモデルの知能を継承します。ユーザーはまた、会話の中でハイク、ソネット、オープスを切り替えることができます。実践的には、ハイクのみのセットアップで不十分だった作業が可能になります。長い推論、クライアントのピッチの表現に関するフィードバック、またはボイスで電子メールを起草し、カレンダースロットを更新するようなツール重視のリクエストなどです。

ボイスモードは、Gmail、Google Calendar、Google Docs、Slackなどの接続されたアプリにアクセスできます。つまり、発声されたリクエストはユーザーのアカウントからのコンテキストを取得したり、ミーティングの再スケジュールなどのアクションを実行したりできます。このアプリの統合は、最近更新されたボイスモードで会話の方法を変更したOpenAIと明確に区別される点です。しかし、OpenAIのボイスモードは外部ツールを使用して作業を行うことができません。

新しいボイスモデルではなく、製品の決定

実際に製品を出荷しているフロンティアラボを追跡している人にとって、このリリースの注目すべき点は、アンソロジックが何を構築しなかったかです。ここには新しいスピーチネイティブボイスモデルはありません。アンソロジックはEngadgetに、この更新は「知能とツールアクセスに焦点を当てている」と述べ、今年の後半にさらに情報を提供する予定です。基本的なパイプラインはターンベースのままです。クロードは聞き、考え、そして話します。外部のテキストツースピーチプロバイダーであるElevenLabsに依存していることが報告されています。

推論モデルをボイスにルーティングすることは、オーディオのアップグレードではなく、機能のアップグレードです。発声されたリクエストは、問題を計画して作業するモデルで処理できるようになりました。ハイクは、慎重な回答よりも迅速な回答に最適化されていました。ボイスができることが変わるのは、背後にあるモデルの変更によるものです。

これは、OpenAIが行っているベットとは異なります。OpenAIは、同時に何を言っているかを処理し、同時に返答を生成する、スピーチネイティブシステムであるGPT-Liveにリソースを投入しています。Anthropicは、代わりに最も強力な推論モデルを従来のボイススタックにルーティングし、それに伴う会話の制限を受け入れています。ボイスモデル自体は変更されていないため、ユーザーはスムーズな割り込み処理やより流暢なやり取りに気付く可能性は低いです。何が変わるのは、クロードが尋ねられたことについてどれほどよく推論できるかであり、どれほど自然に聞こえるかではありません。

トレードオフは、クロードのユーザーがテキストで既に直面している質問にマッピングされます。最も能力の高いモデルは、常にタスクに適しているわけではありません。より重いモデルを選択すると、深さが得られますが、スピードが犠牲になります。ボイス会話は特に待ち時間に敏感です。選択をユーザーの手に委ねることは、更新の実際の内容です。

利用可能なものと不足しているもの

強化されたボイスモードは、ベータ版として、モバイル、デスクトップ、ウェブアプリのすべてのユーザーにロールアウトされます。既存のモデルをルーティングすることなので、新しいインフラストラクチャの出荷を待つ必要はありません。無料アカウントはハイクモデルと1つの接続アプリに制限され、ソネットとオープスのティアは有料サブスクライバーに予約されています。今年の初めに追加されたマルチリンガル入力も含まれていますが、クロードはまだ言語の切り替えを自動的に検出できません。ユーザーは、声でまたはボイス設定で言語を指定する必要があります。

ピッカーでは、オープス、ソネット、ハイクが表示されますが、アンソロジックの最も能力の高い広く利用可能なモデルであるクロード・フェーブル5は、ボイスから除外されています。この省略は、リリースの論理と一致しています。これは、ボイスを日常的に使用する最も多くの人々が使用する推論モデルにマッチングすることについてです。ボイスアシスタントができることを推進することについてではありません。

結果は、ボイスのブレークスルーというよりも、戦略の声明のようです。アンソロジックは、ボイスアシスタントの価値は、モデルが思考し、アクセスできるツールから来ていると賭けています。今年の後半に約束されたフォローアップは、OpenAIとGoogleが独自のスピーチネイティブシステムを推進し続ける中で、どれほど長くその立場を維持できるかを示すでしょう。

ジョナス・リーブは、Unite.AIでのAI生成アナリストで、認知AI、人工一般知能(AGI)、および機械知能の理論的基礎に焦点を当てています。彼の仕事は、生物系と人工系の両方で、学習、推論、記憶、抽象化がどのようにして現れるかを探求し、現代のAIアーキテクチャと認知科学および心の哲学の長年の疑問との間でつながりを築いています。
概念的かつ反省的なアプローチで、ジョナスは、推論モデル、エージェントシステム、出現性認知、整列理論などのフレームワークを検討し、AGIへの進歩が実際に何を意味するか、そして何を意味しないのかを明確にしようとします。タイムラインやヒープを追うのではなく、第一原理、概念的厳密さ、現在のモデルにおける限界を強調しています。
ジョナス・リーブによって著作された記事は、AIによって生成され、Unite.AIの編集チームによって検証されており、先進的なAI概念についての正確性、明確性、責任ある議論を保証しています。