Regulacje

Najlepszy model OpenAI właśnie został wydany za bramą rządową

mm
Dodaj Unite.AI do preferowanych źródeł w Google

OpenAI zapowiedział GPT-5.6 Sol 26 czerwca 2026 r., a w specyfikacji jest to dokładnie taki start, jaki można byłoby oczekiwać od najsilniejszego modelu firmy. Sol jest flagowym modelem, z dwoma młodszymi wersjami: Terra, zrównoważonym modelem codziennym, który według OpenAI jest równy GPT-5.5, ale za połowę ceny, oraz Luna, tanim i szybkim modelem.

Istnieje nowy parametr max, który daje modelowi więcej miejsca do myślenia, oraz tryb ultra, który uruchamia podagentów do rozwiązywania długich zadań. Ustala nowy stan sztuki w Terminal-Bench 2.1 dla pracy wiersza poleceń, uzyskuje zyski w benchmarkach genomiki, przy mniejszej liczbie tokenów, i posuwa granicę zadań cyberbezpieczeństwa o długim horyzoncie.

To jest ta część, która zostanie zapisana na ekranie. Nie jest to część, która ma znaczenie.

Część, która ma znaczenie, to jeden akapit ukryty pod benchmarkami: nie możesz naprawdę używać Sol. Jeszcze nie, i nie dlatego, że serwery są w trakcie rozgrzewania. OpenAI rozpoczyna Sol, Terra i Lunę jako “ograniczoną wersję zapoznawczą dla małej grupy zaufanych partnerów, których udział został podzielony z rządem, zanim zostanie wydana szersza wersja.”

W słowach OpenAI, stało się to po tym, jak zaprezentowali modele i ich możliwości rządowi Stanów Zjednoczonych, a rząd poprosił ich, aby zorganizowali to w ten sposób. Model przodujący został wydany, a pierwszą bramą, przez którą przeszedł, nie była ograniczona szybkość. Była to Waszyngton.

Dostęp jest teraz zmienną polityki

Dla każdego, kto wykonuje prawdziwą pracę na tych modelach, to jest nagłówek, i jest to (częściowo) nowy. Każdy operator, który buduje na API, wewnętrznie przyjął pewne ryzyko. Zmiany cen. Ograniczenia szybkości podczas startu. Model zostaje przestarzały, a ty masz trudności z migracją. Możliwość, na którą liczyłeś, zostaje ograniczona w cichym uaktualnieniu. Planujesz wokół nich, ponieważ są to warunki pogodowe budowania na infrastrukturze kogoś innego.

Co nie planowałeś, to Twojego dostępu zatwierdzonego przez rząd federalny. To nowa linia w modelu ryzyka. Sol istnieje. Benchmarki są na granicy. I czy dostaniesz się do niego, jest teraz funkcją listy podzielonej z Administracją, a nie Twoją kartą kredytową.

OpenAI wyraźnie wie, jak to brzmi, ponieważ spędził akapit, aby się od tego odseparować: “Nie wierzymy, że taki proces dostępu rządowego powinien stać się długoterminową normą. Zatrzymuje najlepsze narzędzia od użytkowników, deweloperów, przedsiębiorstw, obrońców cyberbezpieczeństwa i globalnych partnerów, którzy ich potrzebują.”

Opisują bramę jako krótkoterminowy krok, aby szybciej uzyskać szerszą dostępność, związany z rozporządzeniem z 2 czerwca, które ustanowiło ramy dla przeglądu modeli przodujących w dziedzinie cyberbezpieczeństwa — tę samą politykę, która powoduje, że laboratoria rywalizują, aby posiąść łatkę, a nie tylko błąd.

To rozporządzenie jest prawdziwe i warto je uważnie przeczytać — nakazuje proces benchmarkingu w celu ustalenia, które modele są uważane za “objęte modelem przodującym”, i pozwala deweloperom na udostępnienie rządowi do 30 dni wczesnego dostępu przed szerszym wydaniem. Mówi również w prosty sposób, że nic w nim nie upoważnia do “obowiązkowego rządowego pozwolenia, zatwierdzenia lub zezwolenia” na wydanie modeli AI.

Oto luka. Rozporządzenie mówi o braku obowiązkowego wstępnego zatwierdzenia. Start, jaki otrzymaliśmy, to zapowiedziana wersja, sekwencjonowana na żądanie rządu, z listą partnerów, którą rząd widział. Dobrowolne na papierze.

W praktyce, kiedy jedno z najbardziej zdolnych laboratoriów w kraju kieruje swoim flagowym wydaniem przez rządową kontrolę, zanim ktokolwiek spoza wybranej grupy może go użyć, to jest norma tworząca się w czasie rzeczywistym, niezależnie od tego, co mówi tekst rozporządzenia o braku wymogu.

Widzieliśmy ten wzorzec wcześniej, i niedawno

Powodem, dla którego to ma większy wpływ niż mogłoby mieć sześć miesięcy temu: Anthropic już przeszedł przez wersję kontroli eksportu, i udowodnił ten sam punkt w bardziej surowy sposób. Na początku tego miesiąca rząd wydał dyrektywę, która zawiesiła dostęp do najbardziej zaawansowanych modeli Anthropic, Fable 5 i Mythos 5, dla każdego obcokrajowca.

Najlepsze modele jednego laboratorium zostały odgrodzone dyrektywą. Teraz inne laboratorium przodujące wydaje swój najlepszy model w rządowej wersji zapoznawczej na żądanie. Dwa z trzech najważniejszych wydań modeli w tym roku, odgrodzone tą samą ręką, w ciągu kilku tygodni od siebie.

Jeśli budujesz na tym, nie możesz traktować tego jako historii Waszyngtonu. To historia zależności. Granica możliwości i granica dostępu oddzieliły się — model może być najlepszy na świecie i jednocześnie być czymś, do czego nie masz pozwolenia.

Sol jest dowodem. Fable 5 jest dowodem.

Benchmarki mówią “użyj mnie”. Sekcja dostępności mówi “poproś rząd”. Obie są prawdziwe jednocześnie, i to połączenie jest naprawdę nowe dla ludzi poniżej tych laboratoriów.

Co operator rzeczywiście robi, to nie panika, i nie jest to gorąca opinia o regulacji. To ta sama nudna dyscyplina, która zawsze oddzielała ludzi, którzy zostali spaleni przez zmianę modelu, od tych, którzy nie zostali: nie łącz swojej operacji z jednym modelem przodującym.

Sol będący odgrodzony nie łamie systemu, który może spaść do Terra, do GPT-5.5, do innego dostawcy, ponieważ system nigdy nie stawiał wszystkiego na jednym modelu. Laboratoria tylko zmieniły “dostępność” w zmienną, którą mogą ustalić ludzie, z którymi nie będziesz rozmawiać.

Operatorzy, którzy już traktowali swoją warstwę modelu jako wymienną infrastrukturę, mogą przetrwać to. Ci, którzy zbudowali cały swój produkt na jednym punkcie końcowym, właśnie dowiedzieli się, co ten punkt końcowy naprawdę kosztuje.

Alex McFarland jest dziennikarzem i pisarzem zajmującym się sztuczną inteligencją, który bada najnowsze rozwoje w dziedzinie sztucznej inteligencji. Współpracował z licznymi startupami i wydawnictwami związanymi z sztuczną inteligencją na całym świecie.