Modele și platforme AI
Cerebras lansează Qwen3-235B: O nouă eră pentru viteza, scară și costul inteligenței artificiale

Cerebras Systems (CBRS ) a lansat oficial Qwen3-235B, un model de inteligență artificială de ultimă generație cu suport de context complet de 131.000 de tokeni, stabilind un nou standard de performanță în raționament, generare de cod și aplicații de inteligență artificială la scară întreprindere. Acum disponibil prin Cerebras Inference Cloud, modelul oferă capacități care rivalizează cu cele mai avansate sisteme de frontieră — și funcționează de 30 de ori mai rapid și la o zecime din costul modelelor închise actuale.
Raționamentul inteligenței artificiale în timp real atinge o viteză fără precedent
Raționamentul inteligenței artificiale a fost, istoric, lent, cu modele mari care au necesitat adesea un minut sau mai mult pentru a răspunde la întrebări complexe. Cerebras elimină acest blocaj. Propulsat de motorul său proprietar Wafer-Scale Engine 3 (WSE-3), Qwen3-235B atinge 1.500 de tokeni pe secundă, un record mondial pentru inferența inteligenței artificiale de frontieră.
Acest nivel de performanță transformă experiența utilizatorului — reducând latența de la 60-120 de secunde la doar 0,6 secunde, chiar și atunci când se procesează sarcini avansate de raționament sau se rulează fluxuri de lucru multi-pași, cum ar fi generarea augmentată de recuperare (RAG). Conform rezultatelor testelor de la Artificial Analysis, niciun alt furnizor — deschis sau închis — nu egalează în prezent această viteză de inferență pentru un model de frontieră.
Un nou standard în context: 131K tokeni pentru aplicații din lumea reală
În tandem cu această lansare, Cerebras a extins fereastra de context a modelului său de la 32K la 131K tokeni complet suportați de Qwen3-235B. Acest salt în dimensiunea contextului permite modelului să ingere și să raționeze peste volume masive de date — cuprinzând coduri complete, repository-uri multi-document și material tehnic de lungă durată.
În timp ce contextul de 32K permite sarcini de generare de bază, 131K deschide ușa către dezvoltarea de producție. Inteligența artificială poate funcționa acum ca un colaborator profund de cod, sintetizând zeci de fișiere și gestionând dependențe complexe în timp real — făcând-o ideală pentru cazuri de utilizare la nivel de întreprindere în inginerie software, analiză de documente și calcul științific.
De ce Cerebras este diferit: Hardware proiectat pentru inteligență artificială de la zero
Fondat de o echipă de arhitecți de calculator pionieri, cercetători de inteligență artificială și ingineri de sisteme, Cerebras Systems a adoptat o abordare radical diferită pentru a rezolva provocările escaladării inteligenței artificiale generative. În loc de a se baza pe clusteruri de GPU, Cerebras a construit un supercomputer de inteligență artificială cu scop special în jurul propriului său cip: Wafer-Scale Engine 3.
Acest cip este unic în industrie. Se întinde pe mărimea unei farfurii și găzduiește sute de mii de nuclee optimizate pentru inteligență artificială, cu memorie pe cip măsurată în zeci de gigabiți. Această proiectare permite calculului și memoriei să stea alături — eliminând latența, constrângerile de bandă și complexitatea de orchestrare a soluțiilor tradiționale multi-GPU.
Prin gruparea sistemelor CS-3, Cerebras poate crea supercalculatoare de inteligență artificială capabile să ruleze modele de trilioane de parametri cu ușurință, evitând în același timp povara tehnică a calculului distribuit. Această abordare unificată este baza vitezelor sale record de inferență și a noilor capacități de context ridicat.
Eficiența MoE permite o reducere dramatică a costurilor
Qwen3-235B este construit utilizând o arhitectură mixture-of-experts (MoE) — un design de model care activează doar un subset de experți interni, în funcție de intrare, rezultând o eficiență computațională vast îmbunătățită.
Din cauza acestui fapt, Cerebras poate oferi modelul la un punct de preț care subminează semnificativ alternativele închise. În special, inferența este disponibilă la 0,60 dolari pe milion de tokeni de intrare și 1,20 dolari pe milion de tokeni de ieșire, reprezentând o reducere de peste 90% a costurilor în comparație cu modelele proprietare de la OpenAI, Anthropic sau Google.
Integrare fără efort cu Cline în VS Code
Pentru a demonstra viteza și aplicarea în lumea reală a Qwen3-235B, Cerebras a colaborat cu Cline, agentul de codare agentic principal din Microsoft Visual Studio Code, instalat în prezent de peste 1,8 milioane de dezvoltatori.
Utilizatorii Cline pot accesa deja Qwen3-32B cu context de 64K ca parte a tarifului gratuit. Odată cu anunțul de astăzi, suportul se va extinde pentru a include Qwen3-235B și contextul său complet de 131K, permițând un nivel de raționament și generare de cod în editor în timp real, never mai atins înainte.
Saoud Rizwan, CEO al Cline, a explicat: Cu inferența Cerebras, dezvoltatorii care utilizează Cline primesc o privire de ansamblu asupra viitorului, pe măsură ce Cline raționează prin probleme, citește coduri și scrie cod în timp real. Totul se întâmplă atât de repede încât dezvoltatorii rămân în flux, iterând la viteza gândirii. Această inferență rapidă nu este doar plăcută de avut — ne arată ce este posibil atunci când inteligența artificială ține cu adevărat pasul cu dezvoltatorii.
O alternativă deschisă la modelele închise
Performanța Qwen3-235B este la nivelul unora dintre cele mai sofisticate modele de inteligență artificială de pe piață astăzi, incluzând Claude 4 Sonnet, Gemini 2.5 Flash și DeepSeek R1, așa cum a fost validat de benchmark-uri independente. Cu toate acestea, Cerebras o oferă într-un format de acces deschis, oferind transparență și portabilitate pe care modelele închise le lipsesc.
Acest model deschis de abordare împuternicește întreprinderile să:
- Personalizeze și ajusteze pe date proprietare
- Implementeze inteligență artificială pe infrastructură privată sau în medii de cloud hibrid
- Evite încuierea furnizorului și riscurile de confidențialitate a datelor
Combinate cu platforma de cloud scalabilă a Cerebras și cu opțiunea de implementare pe loc a sistemelor CS-3, organizațiile câștigă control deplin asupra modului în care inteligența artificială este aplicată pentru sarcini critice de misiune.
Ce înseamnă acest lucru pentru industrie
Lansarea Qwen3-235B marchează un punct de cotitură. Cerebras a redefinit granițele a ceea ce este posibil cu modelele de limbaj mare, combinând inteligența de frontieră cu o viteză și eficiență a costurilor fără precedent.
Acum este fezabil să se construiască unelte de inteligență artificială care:
- Răspund în timp real la întrebările dezvoltatorilor
- Raționează peste documentație completă sau baze de cunoștințe
- Generează și depanarează cod de producție live în interiorul IDE-ului
- Se extinde la cazuri de utilizare la nivel de întreprindere fără sprawl de GPU sau facturi de inferență lunare de șase cifre
Pe măsură ce cererea de infrastructură de inteligență artificială crește, Cerebras demonstrează că nu trebuie să faceți compromisuri între performanță, preț și deschidere. Proiectarea sa de hardware și software, de la Wafer-Scale Engine la Cerebras Inference Cloud, indică spre un nou model de implementare a inteligenței artificiale — unul care este mai rapid, mai simplu și mult mai accesibil.
Gând final
Prin lansarea Qwen3-235B cu 131K de context, inferență ultra-rapidă și prețuri de token accesibile, Cerebras Systems s-a poziționat ca unul dintre puținii adevărați concurenți ai furnizorilor de GPU. Pentru întreprinderi, cercetători și dezvoltatori, această lansare este mai mult decât doar un model mai rapid — este un punct de inflexiune care aduce inteligența artificială în timp real, de producție și deschisă la îndemâna lor.












