AIモデルとプラットフォーム

OpenAI、ChatGPTのライブ音声にプラグインを追加、Workで音声を利用可能に

mm
Unite.AI を Google の優先ソースに追加

OpenAIは2026年9月23日、Web、iOS、AndroidのChatGPTにおけるライブ音声体験にプラグインサポートを追加し、WebとモバイルのChatGPT Workに音声機能を導入したと、同社のChatGPT リリースノートで発表しました。このアップデートにより、ユーザーは音声会話中に接続されたアプリを呼び出し、電話やブラウザから音声でWorkタスクを開始できるようになりました。

ライブ音声におけるプラグイン

9月23日のエントリでは、ライブ音声がWeb、iOS、Androidでプラグインをサポートするようになったと述べられています。音声会話中に、ユーザーは自分のアカウントに紐付いたプラグインや接続アプリを利用でき、チャット内のテキスト応答を確認できます。FreeおよびGoプランのユーザーは、プランでサポートされているプラグインとともに音声チャットを利用でき、アカウントの既存のアプリ接続、権限、使用制限は引き継がれます。

OpenAIのChatGPT Voice ヘルプ記事で仕組みが説明されています。ライブ会話中に、ユーザーはアカウントで利用可能なプラグインの使用をChatGPTに依頼します。ユーザーはまずアプリを接続しサインインする必要がある場合があり、既存のアプリ権限やワークスペースの制限は引き続き適用されます。アクションにWebまたはモバイル上で承認が必要な場合、音声は画面上のレビューと承認・却下用コントロールを表示しますが、音声による承認はサポートされていないとOpenAIは述べています。

ChatGPT Workにおける音声

リリースノートによると、WebとモバイルのWorkで音声が利用可能になったとされています。音声で指示することで、ユーザーはWorkで文書、プレゼンテーション、スプレッドシートの下書きを作成したり、接続されたアプリを活用したり、ブラウザ上で操作したりできます。音声通話を終了した時点でタスクがまだ実行中の場合、テキストに切り替えて続行できます。Workで音声を利用するには、アカウントで音声とWorkの両方へのアクセス権が必要です。

ヘルプ記事によれば、Workでの音声はプランの音声利用制限と課金に従い、音声で開始されたタスクはテキスト入力のタスクと同様に通常のWork使用量にカウントされます。この記事では、macOSおよびWindowsのChatGPTデスクトップアプリにおける音声も別途説明されており、ユーザーはタスクの開始、進捗確認、エージェントへの質問、複数エージェントを1つの会話で調整することができます。

音声オプション、使用制限、及び明示された制限事項

ヘルプ記事では、音声オプションが3つ列挙されています。Liveはユーザーのプランに応じてGPT‑Live‑1またはGPT‑Live‑1 miniで動作し、OpenAIはこれを同時に聞き取り・発話でき、ウェブ検索とメモリを利用し、対応ウィジェットを通じて視覚的結果を表示し、同一チャット内でテキストと画像を扱えると説明しています。Advancedは従来のリアルタイム音声体験で、動画や画面共有といったモバイル対応機能を保持していますが、Liveはこれらをサポートしません。Standardはターンバイターン方式で、ユーザーの発話を文字起こしした後に応答を生成します。

Chatでの音声において、Liveの使用量は24時間のローリング期間で測定されます。記事に掲載された制限では、FreeユーザーはGPT‑Live‑1 miniへの限定的なアクセス、GoユーザーはGPT‑Live‑1 miniで最大3時間、PlusユーザーはGPT‑Live‑1で最大3時間、月額$100のPro加入者は最大15時間、月額$200のPro加入者はGPT‑Live‑1を無制限に利用できるとされています。Business StandardはGPT‑Live‑1で3時間が付与され、追加利用は1分あたり1.25クレジットが消費されます。Business Premiumは15時間が付与されます。Enterprise、Edu、Cliniciansのワークスペースはクレジット制で1分あたり1.25クレジットを消費し、Enterpriseの従量課金プランは1分あたり$0.05で請求されます。

OpenAIは、Liveには現在2つの制限があると述べています。動画や画面共有はサポートされておらず、ユーザーのChatGPTライブラリからファイルを検索または追加することは現時点ではできません。ただし、サポート対象のファイルはアカウントに応じて手動でチャットに添付できる場合があります。

記録されたロールアウトパス

9月23日のアップデートは、同じリリースノートに記録されたシーケンスを拡張しています。2026年7月8日、OpenAIは有料ユーザー向けにChatGPT VoiceでGPT‑Live‑1を、Freeユーザー向けにGPT‑Live‑1 miniを導入しました。同社はこれらのモデルが同時に聞き取りと発話が可能で、ターンテイキングや割り込みがより自然に感じられ、chatgpt.comおよびiOS・Androidアプリ全体でウェブ検索、メモリ、視覚ウィジェットを提供すると述べました。2026年7月9日、同社はChatGPT Workを発表しました。これは、情報の調査・分析を行い、接続アプリやファイルを横断して操作し、文書、スプレッドシート、プレゼンテーション、レポート、Sitesを生成する長期・マルチステップ作業用エージェントで、FreeとGoを除く有料プランでWebとモバイルに展開されました。2026年7月23日、ChatGPT VoiceはWorkとデスクトップアプリのCodexで利用可能になりました。

2026年8月31日、ライブ音声会話の内容がiPhoneのロック画面に表示され、対応機種のiPhoneではLive Activitiesを通じてDynamic Islandにも表示できるようになりました。2026年9月9日、OpenAIは、より難しい質問の検索や推論が必要な際に音声がGPT‑5.6またはGPT‑6 Astraを利用できるようにし、プラン別にGPT‑Liveの日次使用制限を簡素化し、Voice制限に達した後にPlusおよびProユーザーをGPT‑Live miniに切り替える慣行を終了し、Instant、Medium、Highという別個の音声インテリジェンスレベルを廃止しました。

ジョナス・リーブは、Unite.AIでのAI生成アナリストで、認知AI、人工一般知能(AGI)、および機械知能の理論的基礎に焦点を当てています。彼の仕事は、生物系と人工系の両方で、学習、推論、記憶、抽象化がどのようにして現れるかを探求し、現代のAIアーキテクチャと認知科学および心の哲学の長年の疑問との間でつながりを築いています。
概念的かつ反省的なアプローチで、ジョナスは、推論モデル、エージェントシステム、出現性認知、整列理論などのフレームワークを検討し、AGIへの進歩が実際に何を意味するか、そして何を意味しないのかを明確にしようとします。タイムラインやヒープを追うのではなく、第一原理、概念的厳密さ、現在のモデルにおける限界を強調しています。
ジョナス・リーブによって著作された記事は、AIによって生成され、Unite.AIの編集チームによって検証されており、先進的なAI概念についての正確性、明確性、責任ある議論を保証しています。