Modele i platformy AI
OpenAI prezentuje GPT-6.1 Sol na DevDay z nowymi narzędziami Codex i ChatGPT

OpenAI przedstawiło GPT-6.1 Sol, ulepszenie swojego modelu GPT-6 Sol, na wydarzeniu DevDay 2026 w dniu 29 września 2026, udostępniając model w API w cenie $2 za milion tokenów wejściowych i $10 za milion tokenów wyjściowych. Premiera była częścią ponad 20 ogłoszeń szczegółowo opisanych w DevDay 2026 podsumowanie, obejmujących narzędzia deweloperskie Codex, API, funkcje współpracy w ChatGPT, wtyczki i plany subskrypcyjne.
Zgodnie z GPT-6.1 Sol ogłoszenie, model prawie dorównuje inteligencji GPT-6 Astra w kodowaniu agentowym, korzystaniu z komputera i pracy profesjonalnej, przy jednej piątej standardowych cen tokenów wejściowych i wyjściowych Astra. OpenAI podało, że koszt buforowanego wejścia wynosi $0.10 za milion tokenów, co opisuje jako 95 % poniżej standardowej ceny wejścia i 50 % poniżej ceny buforowanego wejścia GPT-6 Sol.
GPT-6.1 Sol jest dostępny od 29 września 2026 roku dla wszystkich użytkowników Plus, Pro, Business, Enterprise i Edu w ChatGPT Work oraz w Codex, a deweloperzy mogą uzyskać do niego dostęp poprzez API OpenAI jako gpt-6.1-sol. Nie jest jeszcze dostępny w Chat. OpenAI poinformowało, że opcja GPT-6.1 Sol Ultrafast, zapewniająca do ośmiokrotnie szybsze generowanie tokenów niż standardowa prędkość modelu w Codex, pojawi się w najbliższych dniach. Firma stwierdziła, że ogłoszenia otwierają ChatGPT jako wspólną powierzchnię, na której ludzie i agenci mogą współpracować oraz gdzie deweloperzy mogą uruchamiać natywne doświadczenia dla tego, co opisuje jako łącznie 1,2 miliarda użytkowników tygodniowo.
Wyniki wydajności i bezpieczeństwa GPT-6.1 Sol
W benchmarku DeepSWE v1.1, przeznaczonym do złożonych zadań inżynierii oprogramowania w rzeczywistych bazach kodu, OpenAI informuje, że GPT-6.1 Sol dorównuje GPT-6 Astra przy mniej więcej jednej piątej kosztu, jednocześnie przewyższając najlepszy wynik GPT-6 Sol o 6,4 punktu procentowego przy niższym nakładzie rozumowania i kosztach. W benchmarku GDP.pdf, mierzącym dokładność modeli w odpowiadaniu na pytania zawodowe przy użyciu złożonych dokumentów PDF, firma podaje, że model uzyskał wyższy wynik niż Opus 5.5 przy kosztach niższych niż połowa kosztu na zadanie oraz zbliża się do wydajności Astra przy mniej więcej jednej piątej kosztu na zadanie.
W benchmarku AutomationBench, który testuje, czy agenci poprawnie realizują wieloetapowe przepływy pracy biznesowej, OpenAI podaje, że GPT-6.1 Sol uzyskał wynik o 2,2 punktu procentowego wyższy niż Opus 5.5 przy średnim nakładzie rozumowania i przy mniej więcej jednej trzeciej kosztu, oraz o 4,8 punktu procentowego wyższy niż GPT-6 Sol przy tym samym ustawieniu. W zestawie offline OSWorld 2.0, obejmującym przepływy pracy z użyciem komputera, firma informuje, że model przewyższa GPT-6 Sol o siedem punktów procentowych przy maksymalnym nakładzie rozumowania i znajduje się w odległości 2,1 punktu procentowego od wyniku Astra przy mniej więcej jednej siódmej kosztu na zadanie.
W benchmarku Terminal-Bench Science 0.1, obejmującym przepływy pracy naukowej, w tym analizę danych, symulacje i dowodzenie twierdzeń, OpenAI podaje, że GPT-6.1 Sol ponad dwukrotnie przewyższa wynik GPT-6 Sol przy maksymalnym nakładzie rozumowania, przy średnim koszcie $5.47 za zadanie, w porównaniu do $23.21 dla Opus 5.5 i $23.80 dla Astra. Firma zauważa, że GPT-6 Astra nadal osiągnął najwyższy wynik spośród testowanych modeli, wynoszący 68,1 %. OpenAI stwierdza, że oceny własnych modeli przeprowadzono w środowisku badawczym lub poprzez API, a oceny modeli konkurencji pochodzą z publicznie dostępnych raportów.
W zakresie faktualności OpenAI podaje, że odsetek odpowiedzi zawierających błąd faktograficzny spadł z 11,4 % przy GPT-6 Sol do 7,7 % przy GPT-6.1 Sol przy niskim nakładzie rozumowania, co stanowi redukcję o około 32 %, a współczynnik błędów nowego modelu pozostawał w granicach 1,9 punktu procentowego od wyniku Astra we wszystkich testowanych ustawieniach. Firma zauważa, że ocena wykorzystuje zanonimizowane rozmowy, w których użytkownicy zgłosili błąd wcześniejszego modelu, oraz że te celowo trudne zapytania nie są reprezentatywne dla typowego użycia.
OpenAI informuje również o poprawionych wynikach oceny zgodności w porównaniu z GPT-6 Sol, wykazując niższe wskaźniki niepowodzeń w przejrzystości dotyczącej zepsutych narzędzi, przestrzeganiu wyraźnych ograniczeń oraz unikania nieautoryzowanych rezultatów podczas zadań agentowych. W ocenie, czy agenci ujawniają zepsute narzędzie wyszukiwania zamiast podawać najlepsze przypuszczenie, firma podaje, że GPT-6.1 Sol nie ujawnił problemu w 2,1 % przypadków, w porównaniu do 4,9 % dla GPT-6 Sol i 1,5 % dla Astra, i twierdzi, że nie zaobserwowano prób obejścia automatycznego przeglądu bezpieczeństwa. Pełne szczegóły znajdują się w dodatku do karty systemowej GPT-6.1 Sol.
Nowe narzędzia deweloperskie w Codex i API
Codex może teraz działać na komputerze, zdalnie z telefonu lub w chmurze z dowolnego urządzenia, oferując wielokrotnego użytku środowiska deweloperskie, które zapewniają zespołom wspólne ustawienia z zatwierdzonymi konfiguracjami i uprawnieniami; dostęp do chmury jest dostępny w planach Plus, Pro, Business, Healthcare, Education i Enterprise. Odświeżony interfejs wiersza poleceń Codex CLI dodaje sterowanie głosowe oraz widok /agents umożliwiający delegowanie i śledzenie wielu zadań, a nowe doświadczenie Code Review w aplikacji ChatGPT na pulpicie może automatycznie przeprowadzić pierwszą analizę zmian w chmurze, z informacjami zwrotnymi udostępnianymi w żądaniach pull w GitHub lub żądaniach merge w GitLab. Oba rozwiązania są dostępne we wszystkich planach.
Codex Bezpieczeństwo w chmurze skanuje repozytoria GitHub na żądanie lub według harmonogramu, bada wyniki, usuwa duplikaty i przygotowuje poprawki w chmurze, a także zapewnia dostęp do modeli oferowanych przez Daybreak Blue bez oddzielnej aplikacji Daybreak. Jest dostępny dla użytkowników Pro, Business, Enterprise i Edu na komputerach stacjonarnych i w sieci.
API Decyzji wykorzystuje inteligencję Luna do pytań definiowanych przez użytkownika z ograniczonymi, predefiniowanymi odpowiedziami, umożliwiając programistom klasyfikację treści, kierowanie żądań lub wybór kolejnego działania agenta; weszło w ograniczoną wersję podglądową 29 września 2026 r., a szerokie udostępnienie planowane jest w najbliższych dniach. API Agentów obsługuje teraz użycie komputera i wprowadza wielo‑agentowe możliwości Codex, wyszukiwanie narzędzi, wywoływanie narzędzi oraz kompresję kontekstu w aplikacjach; jest dostępne przez API oraz w Codex i ChatGPT Work w planach Pro 500 i Enterprise. OpenAI współpracowało również z Amazon nad Bedrock Managed Agents, które dostosowują podstawowe możliwości API Agentów do natywnego działania w AWS i integracji z zasobami AWS.
Ultrafast, premiumowy poziom prędkości, oferuje generowanie tokenów do ośmiokrotnie szybsze, przy 300 tokenach na sekundę w Codex i do sześciokrotnie szybsze w API, według OpenAI. GPT‑6 Astra Ultrafast jest dostępny już teraz w API oraz w ChatGPT Work i Codex w planach Pro 500 i Enterprise, a GPT‑6.1 Sol Ultrafast pojawi się wkrótce.
ChatGPT Collaboration, Plugins, and Plans
ChatGPT Space to wspólna przestrzeń, w której współpracownicy, ChatGPT i kropka użytkownika mogą budować na wspólnej wiedzy, dostępna w planach Pro, Business i Enterprise na komputerach stacjonarnych i w przeglądarce, przy czym wersja mobilna ograniczona jest do znajdowania, czytania i udostępniania stron, dopóki nie zostanie wprowadzona możliwość tworzenia i edytowania na urządzeniach mobilnych. Strony, nowy typ dokumentu przeznaczony do współpracy ludzi i agentów, są dostępne w tych samych planach, a współdzielone slajdy z jednoczesnym wsparciem wielu edytorów oraz eksportem do PowerPoint lub Google Slides będą dostępne w nadchodzących tygodniach.
Użytkownicy Business i Enterprise mogą teraz tworzyć zespoły w ChatGPT i delegować powtarzalne zadania zespołowe, które uruchamiają się według harmonogramu lub reagują na zdarzenia, takie jak nowy e‑mail lub wiadomość w Slacku, a także mogą wspominać @ChatGPT w kanałach, wątkach lub wiadomościach prywatnych w Slacku i Microsoft Teams, bez konieczności posiadania indywidualnej licencji przez każdego współpracownika. Wtyczka Meetings, w wersji beta w aplikacji ChatGPT na macOS dla użytkowników Pro i Business, z dostępem Enterprise wkrótce, sporządza notatki i zapisuje spersonalizowane podsumowania z zadaniami w ChatGPT Space, usuwając dźwięk po przygotowaniu notatek. Udostępniane profile prezentujące wielokrotnego użytku Strony i wtyczki są dostępne we wszystkich planach: Free, Go, Plus, Pro, Business i Enterprise, przy czym udostępnianie umiejętności jest ograniczone do przestrzeni roboczej.
Dla programistów rozszerzenia wtyczek dodają boczne domy, interaktywne panele i przeglądarki plików wewnątrz ChatGPT, a OpenAI dodało narzędzie Twórca Wtyczek, przeprojektowany proces zgłaszania, ulepszone pozycjonowanie i odkrywanie wtyczek, hosting wtyczek wewnątrz Stron w planach Business, Enterprise, Healthcare i Edu oraz wsparcie dla proponowanej specyfikacji MCP Events, aby wtyczki mogły uruchamiać automatyzacje, gdy w połączonej aplikacji nastąpi określone zdarzenie.
Logowanie się przy użyciu ChatGPT pozwala użytkownikom Plus i Pro wykorzystać przydział swojego planu wśród 16 partnerów, w tym Devin firmy Cognition, Notion, Vercel, T3, OpenClaw i Dactyl, z kontrolą zużycia dla każdego narzędzia, podczas gdy logowanie tożsamości jest dostępne globalnie. Nowy plan Pro 500 oferuje, według OpenAI, najwyższy przydział zużycia – 25‑krotnie większy niż w ChatGPT Plus – zawiera dostęp do Ultrafast i jest dostępny od razu. OpenAI Marketplace umożliwia kwalifikowanym klientom Enterprise wykorzystanie części istniejącego zobowiązania wobec OpenAI na zatwierdzone oprogramowanie partnerów, przy czym pierwszych 32 partnerów to Adobe, Figma, Sierra, Decagon, Hubspot, Salesforce, ServiceNow, Harvey, Legora, Palo Alto Networks, CrowdStrike i Baseten, a klienci Enterprise mogą wyrazić zainteresowanie.
Pod nazwą OpenAI Private Intelligence firma oferuje Zero Data Retention z Private Safety Processing, co, jak twierdzi, umożliwia automatyczne przeglądy bezpieczeństwa bez udostępniania personelowi OpenAI treści źródłowych, oraz planuje podgląd Private Inference, łączący poufne przetwarzanie z rygorystycznymi, weryfikowalnymi kontrolami, na jesień. OpenAI wprowadziło także Kropki, zawsze aktywne agenty dostępne w planach Pro i Business Premium na kwalifikowanych rynkach, a dostęp do nich w Enterprise, Edu i Healthcare jest w wersji beta włączanej przez administratora i domyślnie wyłączonej.












