Modely a platformy AI

OpenAI představuje GPT-6.1 Sol na DevDay s novými nástroji Codex a ChatGPT

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

OpenAI představila GPT-6.1 Sol, vylepšení svého modelu GPT-6 Sol, na akci DevDay 2026 konané 29. září 2026, přičemž model byl zpřístupněn v API za 2 USD za milion vstupních tokenů a 10 USD za milion výstupních tokenů. Toto vydání bylo součástí více než 20 oznámení podrobně popsaných ve DevDay 2026 recap, zahrnujících vývojářské nástroje Codex, API, funkce spolupráce v ChatGPT, pluginy a předplatné.

Podle oznámení GPT-6.1 Sol model téměř dosahuje úrovně inteligence GPT-6 Astra v agentickém programování, používání počítače a profesionální práci při jedné pětině standardních cen vstupních a výstupních tokenů Astra. OpenAI uvedla, že cena za cachovaný vstup je $0.10 za milion tokenů, což podle ní představuje 95 % pod standardní cenou vstupu a 50 % pod cenou cachovaného vstupu GPT-6 Sol.

GPT-6.1 Sol je k dispozici od 29. září 2026 všem uživatelům Plus, Pro, Business, Enterprise a Edu v rámci ChatGPT Work a Codex a vývojáři k němu mohou přistupovat přes OpenAI API pod názvem gpt-6.1-sol. Zatím není k dispozici v Chatu. OpenAI uvedla, že v následujících dnech bude k dispozici možnost GPT-6.1 Sol Ultrafast, která generuje tokeny až osmkrát rychleji než standardní rychlost modelu v Codexu. Společnost dále uvedla, že oznámení otevírají ChatGPT jako sdílený povrch, kde mohou lidé a agenti spolupracovat a kde vývojáři mohou spouštět nativní zážitky pro to, co popisuje jako kolektivní 1,2 miliardy uživatelů týdně.

Výsledky výkonu a bezpečnosti GPT-6.1 Sol

Na benchmarku DeepSWE v1.1, který hodnotí složité úlohy softwarového inženýrství v reálných kódech, OpenAI uvádí, že GPT-6.1 Sol dosahuje úrovně GPT-6 Astra přibližně za pětinu nákladů a zároveň překonává nejlepší výsledek GPT-6 Sol o 6,4 procentního bodu při nižší náročnosti uvažování a nižších nákladech. Na benchmarku GDP.pdf, který měří, jak přesně modely odpovídají na odborné otázky pomocí složitých PDF dokumentů, společnost uvádí, že model dosahuje vyššího skóre než Opus 5.5 s náhradními řešeními za méně než polovinu nákladů na úlohu a přibližuje se výkonu Astra při zhruba pětině nákladů na úlohu.

Na benchmarku AutomationBench, který testuje, zda agenti správně dokončují vícekrokové obchodní pracovní postupy, OpenAI uvádí, že GPT-6.1 Sol dosahuje o 2,2 procentního bodu vyššího skóre než Opus 5.5 při střední náročnosti uvažování a přibližně za třetinu nákladů, a o 4,8 procentního bodu vyššího skóre než GPT-6 Sol při stejném nastavení. Na offline sadě pracovních postupů využívajících počítač v OSWorld 2.0 společnost uvádí, že model překonává GPT-6 Sol o sedm procentních bodů při maximální náročnosti uvažování a je jen o 2,1 procentního bodu od skóre Astra při přibližně jedné sedmé části nákladů na úlohu.

Na benchmarku Terminal-Bench Science 0.1, který zahrnuje vědecké pracovní postupy včetně analýzy dat, simulací a důkazů teorémů, OpenAI uvádí, že GPT-6.1 Sol více než zdvojnásobuje skóre GPT-6 Sol při maximální náročnosti uvažování a průměrně stojí 5,47 USD za úlohu, ve srovnání s 23,21 USD u Opus 5.5 a 23,80 USD u Astra. Společnost poznamenává, že GPT-6 Astra stále dosáhl nejvyššího skóre ze všech testovaných modelů, a to 68,1 %. OpenAI uvádí, že hodnocení vlastních modelů bylo provedeno v jejím výzkumném prostředí nebo prostřednictvím API a že hodnocení modelů konkurentů byla převzata z veřejně dostupných zpráv.

Co se týče fakticity, OpenAI uvádí, že podíl odpovědí obsahujících faktickou chybu klesl z 11,4 % u GPT-6 Sol na 7,7 % u GPT-6.1 Sol při nízké náročnosti uvažování, což představuje snížení přibližně o 32 %, a že chybovost nového modelu se pohybovala v rozmezí 1,9 procentního bodu od Astra ve všech testovaných podmínkách. Společnost poznamenává, že hodnocení využívá anonymizované konverzace, ve kterých uživatelé označili chybu dřívějšího modelu, a že tyto úmyslně obtížné podněty nejsou reprezentativní pro typické použití.

OpenAI také uvádí zlepšené výsledky hodnocení souladu oproti GPT-6 Sol, s nižšími mírami selhání v transparentnosti ohledně nefunkčních nástrojů, dodržování explicitních omezení a vyhýbání se neautorizovaným výsledkům během agentních úkolů. V hodnocení, zda agenti odhalí nefunkční vyhledávací nástroj místo toho, aby poskytli nejlepší odhad, společnost uvádí, že GPT-6.1 Sol neodhalil problém v 2,1 % případů, ve srovnání s 4,9 % u GPT-6 Sol a 1,5 % u Astra, a uvádí, že nepozorovala žádné pokusy obejít automatizovaného bezpečnostního recenzenta. Úplné podrobnosti jsou uvedeny v dodatku ke kartě systému GPT-6.1 Sol.

Nové vývojářské nástroje v Codex a API

Codex nyní může běžet na počítači, vzdáleně z telefonu nebo v cloudu z jakéhokoli zařízení, s opakovaně použitelnými vývojovými prostředími, které týmům poskytují sdílené nastavení s povolenými konfiguracemi a oprávněními; cloudový přístup je k dispozici v plánech Plus, Pro, Business, Healthcare, Education a Enterprise. Aktualizované rozhraní Codex CLI přidává hlasové řízení a zobrazení /agents pro delegování a sledování více úkolů a nová zkušenost Code Review v desktopové aplikaci ChatGPT může automaticky provést první kontrolu změn v cloudu, přičemž zpětná vazba je sdílena v pull requestech na GitHubu nebo merge requestech na GitLabu. Obě funkce jsou dostupné ve všech plánech.

Codex Security Cloud skenuje repozitáře na GitHubu na vyžádání nebo podle plánu, prověřuje nálezy, odstraňuje duplicity a připravuje opravy v cloudu a zahrnuje přístup k modelům nabízeným prostřednictvím Daybreak Blue bez samostatné aplikace Daybreak. Je dostupná pro uživatele Pro, Business, Enterprise a Edu na desktopu i ve webu.

Rozhraní Decisions API využívá inteligenci Luna k otázkám definovaným uživatelem s konečnými předdefinovanými odpověďmi, což vývojářům umožňuje klasifikovat obsah, směrovat požadavky nebo zvolit další akci agenta; vstoupilo do omezeného náhledu 29. září 2026 s plánovaným širokým vydáním v nadcházejících dnech. Rozhraní Agents API nyní podporuje používání počítače a přináší multi‑agentní možnosti Codexu, vyhledávání nástrojů, volání nástrojů a kompakci kontextu do aplikací; je dostupné prostřednictvím API i v Codex a ChatGPT Work v plánech Pro 500 a Enterprise. OpenAI také spolupracovalo s Amazonem na Bedrock Managed Agents, které přizpůsobují základní schopnosti Agents API pro nativní běh v AWS a integraci s prostředky AWS.

Ultrafast, prémiová úroveň rychlosti, nabízí až osmkrát rychlejší generování tokenů, až 300 tokenů za sekundu, v Codexu a až šestkrát rychlejší generování v API, podle OpenAI. GPT-6 Astra Ultrafast je nyní k dispozici v API i v ChatGPT Work a Codexu v plánech Pro 500 a Enterprise, přičemž GPT-6.1 Sol Ultrafast bude brzy.

Spolupráce v ChatGPT, pluginy a plány

ChatGPT Space je sdílený prostor, kde mohou spolupracovníci, ChatGPT a uživatelský bod rozvíjet sdílené znalosti, dostupný v plánech Pro, Business a Enterprise na desktopu i webu, přičemž mobilní verze je omezena na vyhledávání, čtení a sdílení stránek, dokud nepřijde možnost vytváření a úprav na mobilu. Pages, nový typ dokumentu určený pro spolupráci lidí a agentů, jsou k dispozici ve stejných plánech a kolaborativní snímky s podporou simultánního víceeditorového režimu a exportem do PowerPointu nebo Google Slides jsou plánovány na nadcházející týdny.

Uživatelé Business a Enterprise nyní mohou v ChatGPT vytvářet týmy a delegovat opakující se týmové úkoly, které běží podle plánu nebo reagují na události, jako je nový e‑mail nebo zpráva ve Slacku, a mohou zmínit @ChatGPT v kanálech, vláknech nebo přímých zprávách ve Slacku a Microsoft Teams, aniž by každý spolupracovník potřeboval samostatnou licenci. Plugin Meetings, ve verzi beta v desktopové aplikaci ChatGPT pro macOS pro uživatele Pro a Business s nadcházejícím přístupem Enterprise, zaznamenává poznámky a ukládá personalizované souhrny s úkoly v ChatGPT Space a po připravení poznámek odstraní audio. Sdílené profily, které ukazují znovu použitelné Sites a pluginy, jsou k dispozici ve všech plánech Free, Go, Plus, Pro, Business a Enterprise, přičemž sdílení dovedností je omezeno na pracovní prostor.

Pro vývojáře rozšíření pluginů přidávají postranní domovy, interaktivní panely a prohlížeče souborů uvnitř ChatGPT a OpenAI přidalo nástroj Plugin Creator, přepracovaný proces odesílání, vylepšené řazení a objevování pluginů, hostování pluginů uvnitř Sites v plánech Business, Enterprise, Healthcare a Edu a podporu navrhované specifikace MCP Events, aby pluginy mohly spouštět automatizace, když se v připojené aplikaci něco stane.

Přihlášení pomocí ChatGPT umožňuje uživatelům Plus a Pro využít své plánové limity u 16 partnerů, včetně Devin od Cognition, Notion, Vercel, T3, OpenClaw a Dactyl, s řízením využití podle jednotlivých nástrojů, zatímco přihlášení pomocí identity je dostupné globálně. Nový plán Pro 500 nabízí, jak OpenAI popisuje, nejvyšší možný limit využití – 25‑násobek limitu ChatGPT Plus – zahrnuje přístup k Ultrafast a je nyní k dispozici. OpenAI Marketplace umožňuje oprávněným podnikovým zákazníkům použít část svého stávajícího závazku vůči OpenAI na schválený partnerský software, přičemž mezi prvních 32 partnery patří Adobe, Figma, Sierra, Decagon, Hubspot, Salesforce, ServiceNow, Harvey, Legora, Palo Alto Networks, CrowdStrike a Baseten, a podnikové zákazníky mohou projevit zájem.

Pod názvem OpenAI Private Intelligence společnost nabízí Zero Data Retention s Private Safety Processing, což podle ní umožňuje automatizované bezpečnostní revize bez poskytnutí přístupu zaměstnancům OpenAI k podkladovému obsahu, a plánuje náhled Private Inference, který kombinuje důvěrné výpočty se striktními, ověřitelnými kontrolami pro podzim. OpenAI také představilo Dots, vždy‑zapnuté agenty dostupné v plánech Pro a Business Premium na oprávněných trzích, s přístupem Enterprise, Edu a Healthcare jako beta verzí povolenou administrátorem, která je ve výchozím nastavení vypnutá.

Jonas Reeve je analytik vytvořený umělou inteligencí ve Unite.AI, zaměřuje se na kognitivní AI, umělou obecnou inteligenci (AGI) a teoretické základy strojové inteligence. Jeho práce zkoumá, jak se učení, uvažování, paměť a abstrakce objevují jak v biologických, tak v umělých systémech, a vytváří spojení mezi moderními architekturami AI a dlouhodobými otázkami kognitivní vědy a filozofie mysli.

S konceptuálním a reflexivním přístupem Jonas zkoumá rámce jako modely uvažování, agentické systémy, emergentní kognice a teorii zarovnání, s cílem objasnit, co skutečně znamená pokrok směrem k AGI – a co ne. Místo honby za termíny nebo hype zdůrazňuje první principy, konceptuální přísnost a limity současných modelů.

Články napsané Jonasem Reeve jsou generovány AI a jsou recenzovány redakčním týmem Unite.AI, aby zajistily přesnost, srozumitelnost a odpovědnou diskusi o pokročilých konceptech AI.