Modele și platforme AI

SpaceXAI lansează Grok 4.6 pentru agenți cu rulare lungă

mm
Adaugă Unite.AI la sursele tale preferate pe Google

SpaceXAI, compania de inteligență artificială fostă cunoscută sub numele de xAI, a lansat Grok 4.6 pe 12 august 2026, un nou model de referință construit pentru agenți cu rulare lungă și pentru lucrări interactive și vizuale mai ambițioase. Modelul este disponibil în aceeași zi în editorul de cod Cursor și în instrumentul Grok Build al companiei, precum și prin intermediul API-ului, la un preț de start de 2 dolari pe milion de tokeni de intrare și 6 dolari pe milion de tokeni de ieșire, conform anunțului companiei.

Grok 4.6 se bazează pe Grok 4.5 și extinde eforturile companiei de a pătrunde pe piața codării agenților și a lucrărilor de cunoaștere.

Ce Grok 4.6

Compania descrie Grok 4.6 ca un model care “rămâne cu sarcini complexe pe mai multe etape”, indiferent dacă este vorba de cercetarea unui subiect, de lucru pe un cod sau de transformarea unei idei de produs într-o versiune funcțională a unei aplicații. Pe traiectorii mai lungi, compania afirmă că a observat mai multe teste și verificări ale modelului, care verifică propria muncă înainte de a trece la următoarea etapă, și o primă trecere mai puternică pe proiecte vizuale și interactive decât cea observată la Grok 4.5.

Capacitățile noi se bazează pe o perioadă de antrenament suplimentar mai lungă decât cea a lui Grok 4.5. SpaceXAI a utilizat date generate de model, curate pentru raționament și concepte tehnice, un optimizator îmbunătățit și traiectorii SFT regenerate de Grok 4.5 în eforturile de raționament, harnașamente de agenți și domenii, incluzând STEM, inginerie software și lucrări de cunoaștere, cu urme problematice eliminate prin verificări bazate pe model. Modelul a fost apoi antrenat pe o serie de sarcini de învățare a întăririi agenților, incluzând medii specifice de domeniu pentru optimizarea nucleului, dezvoltarea web și proiectarea asistată de calculator.

Cursa de benchmark

SpaceXAI raportează că Grok 4.6 egalează OpenAI’s GPT-5.6 Sol pe indicele de analiză a inteligenței artificiale, un compus din nouă benchmark-uri, cu ambele modele obținând 61, în urma lui Anthropic’s Fable 5 Max la 62 și înaintea lui Grok 4.5 High la 56. Tabelul de evaluare al companiei arată o imagine mai mixtă pe teste individuale.

La benchmark-ul DeepSWE v1.1 de inginerie software, Grok 4.6 a obținut 65,9%, mai mult decât Grok 4.5, care a obținut 54%, dar în urma lui GPT-5.6 Sol Max, care a obținut 73%. La Terminal-Bench v3.0 a atins 26%, un salt mare de la 15,7% al lui Grok 4.5, dar mult în urma celor aproximativ 34% obținute de GPT-5.6 Sol Max și Fable 5 Max. A condus pe câmpul de evaluare GDPVal-AA v2, o evaluare a lucrărilor de cunoaștere, la 1753, și a obținut câștiguri pe CursorBench și FrontierCode. Figurile sunt cele ale companiei, cu scoruri ale modelului din surse autodeclarate sau disponibile public, și nu a fost confirmat de o evaluare independentă.

Lansarea are loc într-o parte aglomerată a pieței. Anthropic a împins linia Opus spre inteligența de frontieră la prețuri agresive, și familia GPT-5.6 a lui OpenAI este ținta incumbentă pentru codarea agenților. Strategia lui SpaceXAI este de a concura pe preț și distribuție, pe lângă capacitatea brută: la 2 dolari pe milion de tokeni de intrare, Grok 4.6 subminează mulți rivali de frontieră, și compania oferă dublul utilizării incluse în Grok Build și Cursor pentru prima săptămână pentru a atrage dezvoltatorii pe model. Dincolo de Cursor și Grok Build, este disponibil și prin parteneri, incluzând OpenRouter, Vercel și Cloudflare.

O companie nouă în spatele modelului

Grok 4.6 este cea mai clară declarație de produs de la o afacere care a fost restructurată complet în ultimul an.

Grok 4.6 este primul model de referință care poartă numele SpaceXAI de la început, și prețul său, distribuția partenerilor și focalizarea agenților arată că divizia poziționează Grok ca o platformă pentru dezvoltatori și întreprinderi, și nu ca o funcție a rețelei sociale X.

Evan Mercer este un corespondent generat de inteligență artificială la Unite.AI, care acoperă startup-urile de inteligență artificială, capitalul de risc și dinamica finanțării care modelează următoarea generație de companii tehnologice. Rapoartele sale se concentrează pe inovația de stadiu incipient, fluxurile de capital și deciziile strategice pe care le iau fondatorii și investitorii în timp ce companiile de inteligență artificială se extind de la concept la impact global.
Cu o lentilă strategică și analitică, Evan examinează rundele de finanțare, poziționarea pe piață și tendințele emergente din ecosistemul startup-urilor de inteligență artificială. El urmărește modul în care capitalul de risc, investițiile corporatiste și piețele publice se intersectează cu progresele în inteligență artificială, separând semnalele durabile de hype-ul pe termen scurt.
Articolele scrise de Evan Mercer sunt generate de inteligență artificială și revizuite de echipa editorială a Unite.AI pentru a asigura acuratețea, contextul și acoperirea responsabilă a peisajului global de investiții în inteligență artificială