Modele i platformy AI
SpaceXAI Wprowadza Grok 4.6 Dla Długotrwałych Agentów

SpaceXAI, firma sztucznej inteligencji dawniej znana jako xAI, wydała Grok 4.6 w dniu 12 sierpnia 2026 r., nowy flagowy model zbudowany dla długotrwałych agentów i bardziej ambitnych interaktywnych i wizualnych prac. Model jest dostępny tego samego dnia w edytorze kodu Cursor i własnym narzędziu Grok Build firmy, a także za pośrednictwem jego API, w cenie startingowej 2 dolarów za milion tokenów wejściowych i 6 dolarów za milion tokenów wyjściowych, zgodnie z ogłoszeniem firmy.
Grok 4.6 opiera się na Grok 4.5 i rozszerza wysiłki firmy w zakresie kodowania agentywnego i pracy wiedzy.
Co Robi Grok 4.6
Firma opisuje Grok 4.6 jako model, który “pozostaje z złożonymi zadaniami przez wiele kroków”, niezależnie od tego, czy jest to badanie tematu, praca nad kodem, czy tworzenie pierwszej wersji aplikacji. Na dłuższych trajektoriach firma stwierdziła, że model więcej razy testuje i weryfikuje swoją pracę, zanim przejdzie do następnego kroku, i ma silniejsze pierwsze przechwyty na projektach wizualnych i interaktywnych niż w przypadku Grok 4.5.
Wzrost możliwości opiera się na dłuższej uzupełniającej sesji szkoleniowej niż Grok 4.5. SpaceXAI wykorzystała danych wygenerowanych przez model do powodowania i pojęć technicznych, zoptymalizowanego optymalizatora i trajektorii SFT wygenerowanych przez Grok 4.5 w ramach wysiłków powodowania, harnessów agentów i dziedzin, w tym STEM, inżynierii oprogramowania i pracy wiedzy, z problematycznymi śladami wyfiltrowanymi przez sprawdzanie oparte na modelu. Następnie model został przeszkolony na serii zadań z wzmocnionym uczeniem agentywnym, w tym środowiskach domenowych dla optymalizacji jądra, rozwoju sieci Web i projektowania wspomaganego komputerem.
Wyścig Benchmarkowy
SpaceXAI raportuje, że Grok 4.6 jest równy z modelem OpenAI GPT-5.6 Sol w Artificial Analysis Intelligence Index, który składa się z dziewięciu benchmarków, z oboma modelami uzyskującymi wynik 61, za modelem Anthropic Fable 5 Max z wynikiem 62 i przed modelem Grok 4.5 High z wynikiem 56. Własna tabela ocen firmy pokazuje bardziej zróżnicowany obraz w poszczególnych testach.
W teście DeepSWE v1.1 na benchmarku inżynierii oprogramowania Grok 4.6 uzyskał wynik 65,9%, co jest wzrostem w porównaniu z wynikiem 54% modelu Grok 4.5, ale jest niższe niż wynik modelu GPT-5.6 Sol Max, który wyniósł 73%. Na teście Terminal-Bench v3.0 osiągnął wynik 26%, co jest znacznym skokiem w porównaniu z wynikiem 15,7% modelu Grok 4.5, ale jest znacznie niższe niż wynik około 34% uzyskany przez modele GPT-5.6 Sol Max i Fable 5 Max. Lideruje w polu na teście GDPVal-AA v2, oceniającym pracę wiedzy, z wynikiem 1753, i odnotowuje wzrosty na testach CursorBench i FrontierCode. Wyniki te są własnymi danymi firmy, z wynikami modeli trzecich stron pobranymi z samoopisów lub publicznie dostępnych wyników, a niezależna ocena jeszcze ich nie potwierdziła.
Uruchomienie ląduje w zatłoczonym segmencie rynku. Anthropic prowadzi swoją linię Opus w kierunku inteligencji granicznej po agresywnych cenach, a rodzina modeli GPT-5.6 OpenAI jest ugruntowanym celem dla kodowania agentywnego. Strategia SpaceXAI polega na konkurowaniu na cenach i dystrybucji, a nie tylko na surowej zdolności: przy cenie 2 dolarów za milion tokenów wejściowych Grok 4.6 jest tańszy niż wiele rywali z przodu, a firma oferuje podwójne użytkowanie w ramach Grok Build i Cursor przez pierwszy tydzień, aby przyciągnąć deweloperów do modelu. Poza Cursor i Grok Build dostępny jest również za pośrednictwem partnerów, w tym OpenRouter, Vercel i Cloudflare.
Nowa Firma Za Modelem
Grok 4.6 jest najwyraźniejszym oświadczeniem produktowym od firmy, która została całkowicie zrestrukturyzowana w ciągu ostatniego roku.
Grok 4.6 jest pierwszym flagowym modelem, który nosi nazwę SpaceXAI od podstaw, a jego ceny, dystrybucja partnerska i agentywny focus pokazują, że dział Grok jest pozycjonowany jako platforma dla deweloperów i przedsiębiorstw, a nie jako funkcja sieci społecznej X.












