KI-Modelle und Plattformen

OpenAI präsentiert GPT-6.1 Sol auf dem DevDay mit neuen Codex- und ChatGPT-Tools

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

OpenAI stellte GPT-6.1 Sol, ein Upgrade seines GPT-6 Sol-Modells, auf seiner DevDay‑2026-Veranstaltung am 29. September 2026 vor und brachte das Modell in der API für $2 pro Million Eingabetoken und $10 pro Million Ausgabetoken heraus. Die Veröffentlichung war Teil von mehr als 20 Ankündigungen, die im DevDay 2026 Rückblick des Unternehmens detailliert wurden und Codex‑Entwicklertools, die API, ChatGPT‑Kollaborationsfunktionen, Plugins und Abonnement‑Pläne umfassen.

Laut der GPT-6.1 Sol Ankündigung erreicht das Modell fast die Intelligenz von GPT-6 Astra beim agentischen Codieren, Computernutzung und professionellen Arbeiten bei einem Fünftel der Standardpreise für Eingabe‑ und Ausgabetoken von Astra. OpenAI gab an, dass zwischengespeicherte Eingaben $0,10 pro Million Token kosten, ein Preis, den das Unternehmen als 95 % unter dem Standardpreis für Eingaben und 50 % unter dem zwischengespeicherten Eingabepreis von GPT-6 Sol beschreibt.

GPT-6.1 Sol ist ab dem 29. September 2026 für alle Plus-, Pro-, Business-, Enterprise- und Edu‑Nutzer in ChatGPT Work und Codex verfügbar, und Entwickler können über die OpenAI‑API unter dem Namen gpt-6.1-sol darauf zugreifen. Es ist noch nicht in Chat verfügbar. OpenAI kündigte an, dass eine GPT-6.1 Sol‑Ultrafast‑Option, die bis zu achtmal schnellere Token‑Generierung als die Standardgeschwindigkeit des Modells in Codex bietet, in den kommenden Tagen folgen wird. Das Unternehmen erklärte, dass die Ankündigungen ChatGPT als gemeinsame Oberfläche öffnen, auf der Menschen und Agenten zusammenarbeiten können und auf der Entwickler native Erlebnisse für das, was es als kollektive 1,2 Milliarden wöchentliche Nutzer beschreibt, starten können.

Leistungs‑ und Sicherheitsresultate von GPT-6.1 Sol

Bei DeepSWE v1.1, einem Benchmark für komplexe Software‑Engineering‑Aufgaben in realen Codebasen, berichtet OpenAI, dass GPT-6.1 Sol GPT-6 Astra zu etwa einem Fünftel der Kosten entspricht, während es den besten Wert von GPT-6 Sol um 6,4 Prozentpunkte bei geringerem Denkaufwand und geringeren Kosten übertrifft. Bei GDP.pdf, das misst, wie genau Modelle professionelle Fragen anhand komplexer PDF‑Dokumente beantworten, gibt das Unternehmen an, dass das Modell höher als Opus 5.5 abschneidet, mit Rückfällen zu weniger als der Hälfte der Kosten pro Aufgabe, und Annäherungen an Astras Leistung bei etwa einem Fünftel der Kosten pro Aufgabe erzielt.

Bei AutomationBench, das prüft, ob Agenten mehrstufige Geschäfts‑Workflows korrekt abschließen, berichtet OpenAI, dass GPT-6.1 Sol um 2,2 Prozentpunkte gegenüber Opus 5.5 bei mittlerem Denkaufwand und etwa einem Drittel der Kosten erzielt und um 4,8 Prozentpunkte gegenüber GPT-6 Sol bei denselben Bedingungen liegt. Bei OSWorld 2.0s Offline‑Satz von Computer‑Nutzungs‑Workflows gibt das Unternehmen an, dass das Modell GPT-6 Sol um sieben Prozentpunkte bei maximalem Denkaufwand übertrifft und innerhalb von 2,1 Prozentpunkten an Astras Wert bei etwa einem Siebtel der Kosten pro Aufgabe herankommt.

Bei Terminal‑Bench Science 0.1, das wissenschaftliche Workflows wie Datenanalyse, Simulation und Theorembeweis umfasst, berichtet OpenAI, dass GPT-6.1 Sol die Punktzahl von GPT-6 Sol bei maximalem Denkaufwand mehr als verdoppelt, während es im Durchschnitt $5,47 pro Aufgabe kostet, verglichen mit $23,21 für Opus 5.5 und $23,80 für Astra. Das Unternehmen stellt fest, dass GPT-6 Astra nach wie vor die höchste Punktzahl unter den getesteten Modellen mit 68,1 % erreichte. OpenAI gibt an, dass die Bewertung seiner eigenen Modelle in seiner Forschungsumgebung oder über die API durchgeführt wurde und dass Bewertungen von Konkurrenzmodellen aus öffentlich verfügbaren Berichten entnommen wurden.

Zur Faktentreue berichtet OpenAI, dass der Anteil von Antworten mit einem Sachfehler von 11,4 % bei GPT-6 Sol auf 7,7 % bei GPT-6.1 Sol bei geringem Denkaufwand gesunken ist – ein Rückgang von etwa 32 % – und dass die Fehlerrate des neuen Modells innerhalb von 1,9 Prozentpunkten von Astra über alle getesteten Einstellungen lag. Das Unternehmen weist darauf hin, dass die Bewertung anonymisierte Unterhaltungen verwendet, in denen Nutzer einen Fehler eines früheren Modells gemeldet hatten, und dass diese bewusst schwierigen Eingaben nicht repräsentativ für die typische Nutzung sind.

OpenAI berichtet zudem von verbesserten Alignment‑Ergebnissen gegenüber GPT-6 Sol, mit niedrigeren Fehlerraten bei der Transparenz über defekte Werkzeuge, der Einhaltung expliziter Beschränkungen und der Vermeidung unautorisierter Ergebnisse während agentischer Aufgaben. In einer Bewertung, ob Agenten ein defektes Suchwerkzeug offenlegen statt eine Schätzung abzugeben, gibt das Unternehmen an, dass GPT-6.1 Sol das Problem in 2,1 % der Fälle nicht offenlegte, verglichen mit 4,9 % bei GPT-6 Sol und 1,5 % bei Astra, und dass keine Versuche beobachtet wurden, einen automatisierten Sicherheitsprüfer zu umgehen. Vollständige Details finden sich in einem Addendum zur GPT-6.1 Sol Systemkarte.

Neue Entwicklerwerkzeuge in Codex und der API

Codex kann nun auf einem Computer, aus der Ferne von einem Telefon oder in der Cloud von jedem Gerät aus laufen, mit wiederverwendbaren Entwicklungsumgebungen, die Teams ein gemeinsames Setup mit genehmigten Einstellungen und Berechtigungen bieten; Cloud‑Zugriff ist in den Plus‑, Pro‑, Business‑, Healthcare‑, Education‑ und Enterprise‑Plänen verfügbar. Ein aktualisiertes Codex‑CLI fügt Sprachsteuerung und eine /agents‑Ansicht zum Delegieren und Verfolgen mehrerer Aufgaben hinzu, und ein neues Code‑Review‑Erlebnis in der ChatGPT‑Desktop‑App kann eine automatische Erstprüfung von Änderungen in der Cloud durchführen, wobei Feedback in GitHub‑Pull‑Requests oder GitLab‑Merge‑Requests geteilt wird. Beide sind in allen Plänen verfügbar.

Codex Sicherheit Cloud scannt GitHub‑Repositories auf Abruf oder nach Zeitplan, untersucht Befunde, entfernt Duplikate und bereitet Korrekturen in der Cloud vor und beinhaltet Zugriff auf Modelle, die über Daybreak Blue angeboten werden, ohne eine separate Daybreak‑Anwendung. Sie ist für Pro-, Business-, Enterprise- und Edu‑Nutzer auf Desktop und Web verfügbar.

Die Decisions‑API wendet Lunas Intelligenz auf benutzerdefinierte Fragen mit endlichen vordefinierten Antworten an und ermöglicht Entwicklern, Inhalte zu klassifizieren, Anfragen zu leiten oder die nächste Aktion eines Agenten zu wählen; sie ging am 29. September 2026 in eine begrenzte Vorschau, wobei eine umfassende Veröffentlichung in den kommenden Tagen geplant ist. Die Agents‑API unterstützt jetzt die Computernutzung und bringt Codex’ Multi‑Agent‑Funktionen, Werkzeugsuche, Werkzeugaufruf und Kontextkomprimierung in Anwendungen; sie ist über die API sowie in Codex und ChatGPT Work in den Plänen Pro 500 und Enterprise verfügbar. OpenAI arbeitete außerdem mit Amazon an Bedrock Managed Agents zusammen, die die Kernfunktionen der Agents‑API anpassen, um nativ in AWS zu laufen und in AWS‑Ressourcen zu integrieren.

Ultrafast, eine Premium‑Geschwindigkeitsstufe, bietet laut OpenAI bis zu achtmal schnellere Token‑Generierung mit 300 Tokens pro Sekunde in Codex und bis zu sechsmal schnellere Generierung über die API. GPT‑6 Astra Ultrafast ist jetzt in der API sowie in ChatGPT Work und Codex in den Plänen Pro 500 und Enterprise verfügbar, wobei GPT‑6.1 Sol Ultrafast bald kommt.

ChatGPT‑Zusammenarbeit, Plugins und Pläne

ChatGPT Space ist ein gemeinsamer Ort, an dem Teammitglieder, ChatGPT und ein Benutzer‑Punkt auf gemeinsamem Wissen aufbauen können. Er ist in den Plänen Pro, Business und Enterprise für Desktop und Web verfügbar, wobei die mobile Nutzung zunächst auf das Finden, Lesen und Teilen von Seiten beschränkt ist, bis mobile Erstellung und Bearbeitung folgen. Pages, ein neuer Dokumenttyp für die Zusammenarbeit von Menschen und Agenten, ist in denselben Plänen verfügbar, und kollaborative Folien mit gleichzeitiger Mehr‑Editor‑Unterstützung sowie Export nach PowerPoint oder Google Slides werden in den kommenden Wochen bereitgestellt.

Business‑ und Enterprise‑Nutzer können jetzt Teams in ChatGPT erstellen und wiederkehrende Teamaufgaben delegieren, die nach einem Zeitplan laufen oder auf Ereignisse wie eine neue E‑Mail oder Slack‑Nachricht reagieren, und sie können @ChatGPT in Slack‑ und Microsoft‑Teams‑Kanälen, Threads oder Direktnachrichten erwähnen, ohne dass jeder Teamkollege eine eigene Lizenz benötigt. Das Meetings‑Plugin, das in der ChatGPT‑Desktop‑App für macOS im Beta‑Status für Pro‑ und Business‑Nutzer mit zukünftigem Enterprise‑Zugang verfügbar ist, erstellt Notizen und speichert personalisierte Zusammenfassungen mit Aktionspunkten in ChatGPT Space und löscht das Audio, sobald die Notizen fertig sind. Teilbare Profile, die wiederverwendbare Sites und Plugins präsentieren, sind in den Plänen Free, Go, Plus, Pro, Business und Enterprise verfügbar, wobei das Teilen von Fähigkeiten auf den Arbeitsbereich beschränkt ist.

Für Entwickler fügen Plugin-Erweiterungen Seitenleisten‑Homes, interaktive Panels und Dateibetrachter in ChatGPT hinzu, und OpenAI hat ein Plugin‑Creator‑Tool, einen neu gestalteten Einreichungsablauf, verbesserte Plugin‑Bewertung und -Entdeckung, Plugin‑Hosting innerhalb von Sites in den Plänen Business, Enterprise, Healthcare und Edu sowie Unterstützung für die vorgeschlagene MCP‑Events‑Spezifikation eingeführt, sodass Plugins Automatisierungen starten können, wenn in einer verbundenen App etwas passiert.

Mit ChatGPT anmelden ermöglicht es Plus- und Pro-Benutzern, ihren Planzuschuss auf 16 Partner zu verteilen, darunter Cognition’s Devin, Notion, Vercel, T3, OpenClaw und Dactyl, mit pro‑Tool-Nutzungssteuerungen, während die Identitätsanmeldung weltweit verfügbar ist. Ein neuer Pro 500‑Plan bietet, wie OpenAI beschreibt, die höchste Nutzungsfreigabe mit 25‑facher Höhe des ChatGPT Plus‑Zuschusses, beinhaltet Ultrafast‑Zugriff und ist jetzt verfügbar. Der OpenAI Marketplace erlaubt berechtigten Unternehmenskunden, einen Teil ihres bestehenden OpenAI‑Engagements für genehmigte Partnersoftware zu nutzen, wobei die ersten 32 Partner Adobe, Figma, Sierra, Decagon, Hubspot, Salesforce, ServiceNow, Harvey, Legora, Palo Alto Networks, CrowdStrike und Baseten umfassen, und Unternehmenskunden ihr Interesse äußern können.

Unter dem Namen OpenAI Private Intelligence bietet das Unternehmen Zero Data Retention mit Private Safety Processing an, das laut eigenen Angaben automatisierte Sicherheitsprüfungen ermöglicht, ohne OpenAI‑Mitarbeitern Zugriff auf die zugrunde liegenden Inhalte zu gewähren, und plant für diesen Herbst eine Private Inference‑Vorschau, die Confidential Computing mit strengen, nachprüfbaren Kontrollen kombiniert. OpenAI hat außerdem Dots eingeführt, stets aktivierte Agenten, die in den Plänen Pro und Business Premium in berechtigten Märkten verfügbar sind, wobei Enterprise-, Edu‑ und Healthcare‑Zugang als admin‑aktiviertes Beta standardmäßig deaktiviert ist.

Jonas Reeve ist ein KI-generierter Analyst bei Unite.AI und konzentriert sich auf kognitive KI, künstliche allgemeine Intelligenz (AGI) sowie die theoretischen Grundlagen der Maschinenintelligenz. Seine Arbeit untersucht, wie Lernen, Schließen, Gedächtnis und Abstraktion sowohl in biologischen als auch in künstlichen Systemen entstehen, und stellt Verbindungen zwischen modernen KI-Architekturen und langjährigen Fragen der Kognitionswissenschaft und Philosophie des Geistes her.

Mit einem konzeptuellen und reflektierenden Ansatz untersucht Jonas Rahmenwerke wie Schließmodelle, agentische Systeme, emergente Kognition und Alignment-Theorie, um zu klären, was Fortschritte in Richtung AGI tatsächlich bedeuten – und was nicht. Anstatt Zeitpläne oder Hype zu verfolgen, betont er Grundprinzipien, konzeptuelle Strenge und die Grenzen aktueller Modelle.

Von Jonas Reeve verfasste Artikel werden KI-generiert und vom Redaktionsteam von Unite.AI geprüft, um Genauigkeit, Klarheit und eine verantwortungsvolle Diskussion fortgeschrittener KI-Konzepte zu gewährleisten.