Modele i platformy AI

SpaceXAI wypuszcza Grok 4.7 do programowania i pracy z wiedzą

mm
Dodaj Unite.AI do preferowanych źródeł w Google

SpaceXAI 21 września 2026 roku wypuściło Grok 4.7, swój najnowszy model do programowania i pracy z wiedzą, w cenie od $2 za milion tokenów wejściowych i $6 za milion tokenów wyjściowych.

W ogłoszeniu wydania SpaceXAI opisuje Grok 4.7 jako swój najbardziej wydajny model do programowania i pracy z wiedzą, twierdząc, że działa dłużej przy trudnych zadaniach i dokładniej weryfikuje własną pracę. Firma podaje, że model posiada najdokładniej skalibrowane zabezpieczenia dotychczas, jest dostępny w tej samej cenie i prędkości co jego poprzednik, Grok 4.6, oraz jest dwa razy szybszy przy połowie kosztu w porównaniu z podobnymi modelami.

Większy model bazowy, dłuższy trening

Zgodnie z ogłoszeniem, Grok 4.7 wykorzystuje nowy, większy model bazowy niż Grok 4.6 i został wytrenowany w ramach dłuższego procesu uczenia ze wzmocnieniem na trudniejszym zestawie zadań, z naciskiem na problemy wymagające wielu godzin do ukończenia. SpaceXAI twierdzi, że powstały model lepiej weryfikuje własną pracę i radzi sobie z dłuższym kontekstem.

Firma dodaje, że wytrenowała Grok 4.7, aby natywnie rozumiał środowisko Grok Bot, co czyni go lepszym w zadaniach konwersacyjnych i ogólnej pracy z wiedzą. SpaceXAI wprowadziło Grok Bot 11 sierpnia 2026 roku, opisując go jako zespół zawsze‑aktywnych agentów posiadających własny komputer, pracujących wewnątrz narzędzi i aplikacji oraz działających całą dobę. Ponadto firma twierdzi, że Grok 4.7 lepiej radzi sobie z tworzeniem dokumentów i prezentacji.

Grok 4.7 następuje po Grok 4.6, który SpaceXAI ogłosiło 12 sierpnia 2026, opisując go jako rozwinięcie Grok 4.5 z szczególnym naciskiem na długotrwałych agentów oraz bardziej ambitne prace interaktywne i wizualne. Później, w sierpniu 2026 roku, firma rozszerzyła Grok 4.6 o GitHub Copilot, Amazon Bedrock, Gemini Enterprise Agent Platform i Microsoft Foundry, zgodnie z datowanymi wpisami w swoim archiwum wiadomości.

Zgłoszone wyniki benchmarków

SpaceXAI opublikowało tabelę benchmarków i cen porównującą Grok 4.7 z Grok 4.6, GPT‑5.6 Sol i Fable 5.1. W tabeli Grok 4.7 jest oznaczony ustawieniem wysiłku oznaczonym jako xhigh, Grok 4.6 jako high, a GPT‑5.6 Sol i Fable 5.1 jako max.

W testach CursorBench 4.0, które SpaceXAI twierdzi, że obciążają długotrwałe zadania programistyczne, firma podaje, że Grok 4.7 uzyskał wynik 46,3 %, w porównaniu do 40,4 % dla Grok 4.6, 41,7 % dla GPT‑5.6 Sol i 51,8 % dla Fable 5.1. SpaceXAI stwierdza, że Grok 4.7 znajduje się na czele pod względem stosunku ceny do wydajności w tym benchmarku.

W ocenie DeepSWE v1.1, będącej oceną inżynierii oprogramowania, SpaceXAI podaje wynik 71,0 % dla Grok 4.7 przy wysokim wysiłku, w porównaniu do 65,2 % dla Grok 4.6, 72,7 % dla GPT‑5.6 Sol i 70,0 % dla Fable 5.1. W benchmarku Terminal‑Bench 4.0, obejmującym wielogodzinne zadania w terminalu, podane wyniki to 38,0 % dla Grok 4.7, 20,3 % dla Grok 4.6, 37,3 % dla GPT‑5.6 Sol i 57,9 % dla Fable 5.1.

W benchmarku AA Briefcase v1.1, mierzącym wielogodzinny pracę biurową, podane wyniki to 1 657 dla Grok 4.7, 1 546 dla Grok 4.6, 1 487 dla GPT‑5.6 Sol i 1 678 dla Fable 5.1. SpaceXAI podaje 19,6 % dla Grok 4.7 w benchmarku Harvey Legal Agent, w porównaniu do 15,8 % dla Grok 4.6, 2,5 % dla GPT‑5.6 Sol i 6,7 % dla Fable 5.1. W benchmarku HealthBench Professional, ocenie rozumowania klinicznego, podane wyniki to 56,7 % dla Grok 4.7, 48,5 % dla Grok 4.6, 60,5 % dla GPT‑5.6 Sol i 62,1 % dla Fable 5.1. W EEBench, obejmującym inżynierię elektryczną, firma podaje 64,0 % dla Grok 4.7, 53,0 % dla Grok 4.6, 39,4 % dla GPT‑5.6 Sol i 56,4 % dla Fable 5.1.

Oddzielny wykres GDPval podaje wyniki Elo: 1 735 dla Fable 5.1 przy maksymalnym wysiłku, 1 695 dla Grok 4.7, 1 605 dla Grok 4.6 i 1 542 dla GPT‑6 Astra przy maksymalnym wysiłku. SpaceXAI twierdzi, że GDPval i AA Briefcase wymagają od modeli AI wykonywania zadań typowych dla profesjonalistów, takich jak prawnicy, pielęgniarki i analitycy finansowi, oraz że Grok 4.7 przewyższa Grok 4.6 w obu benchmarkach, jednocześnie osiągając wyniki porównywalne z innymi modelami na czele.

Tabela zawiera także ceny tokenów: $2 za milion tokenów wejściowych i $6 za milion tokenów wyjściowych dla Grok 4.7 i Grok 4.6, $4 i $20 dla GPT‑5.6 Sol oraz $10 i $50 dla Fable 5.1.

Zabezpieczenia i cyberbezpieczeństwo

SpaceXAI twierdzi, że Grok 4.7 został zbudowany z zupełnie nowej warstwy zabezpieczeń i jest najmocniejszym modelem, jaki firma testowała pod kątem odrzuceń i odporności na jailbreak. W dziedzinach podwójnego zastosowania, takich jak cyberbezpieczeństwo i prace biologiczne, firma podaje, że Grok 4.7 przoduje zarówno w użyteczności przy nieszkodliwych zadaniach, jak i w bezpiecznym odrzucaniu niebezpiecznych, osiągając najwyższy wynik w benchmarku biosafety LatchBio na poziomie 62,4 %.

W benchmarku HackerBench v0.3, który SpaceXAI opisuje jako własny test ryzykownych i złośliwych zadań cybernetycznych, firma podaje, że Grok 4.7 przepuścił jedynie 3,3 % ryzykownych promptów podwójnego zastosowania, jednocześnie rzadko blokując legalną pracę z zakresu bezpieczeństwa. SpaceXAI informuje, że rozpoczęło także udzielanie wybranym partnerom z dziedziny cyberbezpieczeństwa dostępu wyłącznie na zaproszenie do możliwości red‑team modelu Grok 4.7 w celach badań obronnych.

LatchBio wcześniej oceniło Grok 4.6 pod kątem monitorowania biozabezpieczeń i zadań biologicznych o charakterze adwersarialnym, zgodnie z wpisem z 1 września 2026 roku w archiwum wiadomości firmy, w którym stwierdzono, że wcześniejszy model wykrywał i odrzucał niebezpieczne zapytania bardziej niezawodnie niż jakikolwiek inny system na czele.

Cennik i dostępność

Grok 4.7 jest dostępny od 21 września 2026 r. w Cursor i w Grok Build, agent programistyczny SpaceXAI, a także poprzez API Grok, zewnętrzne narzędzia programistyczne oraz routery modeli i platformy chmurowe.

Obok standardowych cen, SpaceXAI oferuje szybką wersję Grok 4.7 z dwukrotnie większą prędkością generowania przy dwukrotnie wyższej cenie. Firma udostępnia również bezpłatny dostęp do modelu w ramach Grok Build pod adresem x.ai/build.

Jonas Reeve jest analitykiem wygenerowanym przez AI w Unite.AI, specjalizującym się w sztucznej inteligencji kognitywnej, ogólnej inteligencji sztucznej (AGI) oraz teoretycznych podstawach inteligencji maszynowej. Jego praca bada, jak uczenie się, rozumowanie, pamięć i abstrakcja pojawiają się w systemach biologicznych i sztucznych, nawiązując połączenia między nowoczesnymi architekturami AI a długotrwałymi pytaniami w nauce o poznaniu i filozofii umysłu.
Z konceptualnym i refleksyjnym podejściem, Jonas bada ramy takie jak modele rozumowania, systemy agenty, emergentna percepcja i teoria dopasowania, mając na celu wyjaśnienie, co oznacza postęp w kierunku AGI - i co nie. Zamiast gonienia za harmonogramami lub hiperem, kładzie nacisk na pierwsze zasady, konceptualną surowość i granice obecnych modeli.
Artykuły napisane przez Jonasa Reeve są wygenerowane przez AI i sprawdzane przez zespół redakcyjny Unite.AI, aby zapewnić dokładność, klarowność i odpowiedzialną dyskusję zaawansowanych pojęć AI.