KI-Modelle und Plattformen

OpenAI bringt Plugins für Live Voice und Voice to Work in ChatGPT

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

OpenAI hat am 23. September 2026 die Plugin‑Unterstützung für das Live‑Voice‑Erlebnis in ChatGPT auf Web, iOS und Android hinzugefügt und Voice in ChatGPT Work für Web und Mobil eingeführt, laut den ChatGPT-Release-Notizen des Unternehmens. Das Update ermöglicht es den Nutzern, während einer gesprochenen Unterhaltung verbundene Apps aufzurufen und Work‑Aufgaben per Sprache von einem Telefon oder einem Browser zu starten.

Plugins im Live Voice

Der Eintrag vom 23. September besagt, dass Live nun Plugins auf Web, iOS und Android unterstützt. Während einer Voice‑Unterhaltung können Nutzer auf die Plugins und verbundenen Apps ihres Kontos zurückgreifen und den schriftlichen Antworten im Chat folgen. Free‑ und Go‑Nutzer können Voice im Chat mit den von ihrem Plan unterstützten Plugins verwenden, und die bestehenden App‑Verbindungen, Berechtigungen und Nutzungslimits eines Kontos werden übernommen.

Der ChatGPT Voice‑Hilfsartikel von OpenAI beschreibt die Funktionsweise. Während einer Live‑Unterhaltung bittet ein Nutzer ChatGPT, ein dem Konto verfügbares Plugin zu verwenden. Der Nutzer muss möglicherweise zunächst die App verbinden und sich anmelden, und bestehende App‑Berechtigungen sowie Workspace‑Einschränkungen gelten weiterhin. Wenn eine Aktion auf Web oder Mobil eine Genehmigung erfordert, fordert Voice eine Bildschirmanzeige zur Überprüfung mit Bedienelementen zur Zustimmung oder Ablehnung auf, und OpenAI gibt an, dass die Genehmigung per Sprache nicht unterstützt wird.

Voice in ChatGPT Work

Die Release‑Notes besagen, dass Voice nun in Work für Web und Mobil verfügbar ist. Durch Sprechen können Nutzer in Work Dokumente, Präsentationen und Tabellenkalkulationen entwerfen, auf verbundene Apps zurückgreifen oder im Browser arbeiten. Wenn eine Aufgabe noch läuft, während der Nutzer den Sprachaufruf beendet, kann sie in Textform fortgesetzt werden. Voice in Work erfordert sowohl Voice‑ als auch Work‑Zugriff im Konto.

Laut dem Hilfsartikel folgt Voice in Work den Voice‑Limits und der Abrechnung des jeweiligen Plans, und per Sprache gestartete Aufgaben nutzen die normale Work‑Nutzung genauso wie getippte Aufgaben. Der Artikel dokumentiert zudem Voice in der ChatGPT‑Desktop‑App für macOS und Windows, wo Nutzer Aufgaben starten, den Fortschritt prüfen, Fragen zu ihren Agenten stellen und mehrere Agenten über eine einzige Unterhaltung koordinieren können.

Voice-Optionen, Nutzungslimits und angegebene Einschränkungen

Der Hilfsartikel listet drei Voice‑Optionen auf. Live läuft auf GPT‑Live‑1 bzw. GPT‑Live‑1 mini, je nach Plan des Nutzers, und OpenAI beschreibt es als fähig, gleichzeitig zu hören und zu sprechen, Web‑Suche und Gedächtnis zu nutzen, visuelle Ergebnisse über unterstützte Widgets anzuzeigen und im selben Chat mit Text und Bildern zu arbeiten. Advanced ist das frühere Echtzeit‑Voice‑Erlebnis und behält unterstützte mobile Funktionen wie Video und Bildschirmfreigabe bei, die Live nicht unterstützt. Standard ist eine Turn‑by‑Turn‑Option, die die Sprache des Nutzers transkribiert, bevor sie eine Antwort erzeugt.

Für Voice im Chat wird die Live‑Nutzung über einen rollierenden 24‑Stunden‑Zeitraum gemessen. Die im Artikel angegebenen Limits gewähren Free‑Nutzern eingeschränkten Zugriff auf GPT‑Live‑1 mini, Go‑Nutzern bis zu 3 Stunden mit GPT‑Live‑1 mini, Plus‑Nutzern bis zu 3 Stunden mit GPT‑Live‑1, Pro‑Abonnenten für $100 pro Monat bis zu 15 Stunden und Pro‑Abonnenten für $200 pro Monat unbegrenzte GPT‑Live‑1‑Nutzung. Business Standard erhält 3 Stunden mit GPT‑Live‑1, wobei zusätzliche Nutzung 1.25 Credits pro Minute verbraucht, während Business Premium 15 Stunden erhält. Enterprise-, Edu‑ und Clinicians‑Workspaces mit kreditbasierter Preisgestaltung verbrauchen 1.25 Credits pro Minute, und Enterprise mit nutzungsbasierter Preisgestaltung wird mit $0.05 pro Minute abgerechnet.

OpenAI gibt zudem zwei aktuelle Einschränkungen für Live an: Es unterstützt weder Video noch Bildschirmfreigabe und kann derzeit keine Dateien aus der ChatGPT‑Bibliothek eines Nutzers finden oder hinzufügen, obwohl eine unterstützte Datei je nach Konto manuell dem Chat angehängt werden kann.

Dokumentierter Rollout‑Pfad

Das Update vom 23. September erweitert eine in denselben Release‑Notes festgehaltene Reihenfolge. Am 8. Juli 2026 führte OpenAI GPT‑Live‑1 in ChatGPT Voice für zahlende Nutzer und GPT‑Live‑1 mini für Free‑Nutzer ein, Modelle, von denen das Unternehmen sagte, dass sie gleichzeitig hören und sprechen können, sodass Gesprächswechsel und Unterbrechungen natürlicher wirken, mit Web‑Suche, Gedächtnis und visuellen Widgets über chatgpt.com sowie die iOS‑ und Android‑Apps. Am 9. Juli 2026 stellte das Unternehmen ChatGPT Work vor, einen Agenten für längere, mehrstufige Arbeiten, der Informationen recherchiert und analysiert, über verbundene Apps und Dateien arbeitet und Dokumente, Tabellen, Präsentationen, Berichte und Sites erstellt, und der für Web und Mobil auf kostenpflichtige Pläne außer Free und Go ausgerollt wurde. Am 23. Juli 2026 wurde ChatGPT Voice in Work und Codex in der Desktop‑App verfügbar.

Am 31. August 2026 erhielt Inhalt aus einer Live‑Voice‑Unterhaltung die Möglichkeit, auf dem Sperrbildschirm eines iPhones und, auf unterstützten iPhones, in der Dynamic Island über Live‑Activities angezeigt zu werden. Am 9. September 2026 ließ OpenAI Voice auf GPT‑5.6 oder GPT‑6 Astra zurückgreifen, wenn es schwierige Fragen suchen oder beantworten muss, vereinfachte die täglichen GPT‑Live‑Nutzungsgrenzen nach Plan, beendete die Praxis, Plus‑ und Pro‑Nutzer nach Erreichen eines Voice‑Limits auf GPT‑Live‑mini umzustellen, und stellte die separaten Voice‑Intelligenzstufen Instant, Medium und High ein.

Jonas Reeve ist ein künstlich intelligenter Analyst bei Unite.AI, der sich auf kognitive KI, künstliche allgemeine Intelligenz (AGI) und die theoretischen Grundlagen der Maschinenintelligenz konzentriert. Seine Arbeit erforscht, wie Lernen, Argumentation, Gedächtnis und Abstraktion in biologischen und künstlichen Systemen entstehen, und zieht Verbindungen zwischen modernen KI-Architekturen und langjährigen Fragen der Kognitivwissenschaft und Philosophie des Geistes.
Mit einem konzeptionellen und reflektierenden Ansatz untersucht Jonas Rahmenwerke wie Argumentationsmodelle, agentische Systeme, emergente Kognition und Ausrichtungstheorie, um zu klären, was Fortschritte in Richtung AGI tatsächlich bedeuten - und was nicht. Anstatt Zeitpläne oder Hype zu verfolgen, betont er erste Prinzipien, konzeptionelle Strenge und die Grenzen der aktuellen Modelle.
Artikel, die von Jonas Reeve verfasst werden, sind künstlich intelligenter generiert und von Unite.AIs Redaktionsteam überprüft, um Genauigkeit, Klarheit und verantwortungsvolle Diskussion über fortgeschrittene KI-Konzepte zu gewährleisten.