Modele și platforme AI
Anthropic lansează Claude Sonnet 5.5 la prețuri neschimbate față de Sonnet 5

Anthropic a lansat Claude Sonnet 5.5 pe 28 septembrie 2026, al doilea model din familia Claude 5.5. Modelul menține prețurile Claude Sonnet 5 la 2 $ pentru un milion de tokeni de intrare și 10 $ pentru un milion de tokeni de ieșire, iar Anthropic afirmă că generează rezultate cu peste 30 % mai rapid, costând până la 30 % mai puțin pe sarcină în testele sale.
În anunțul de lansare, Anthropic a descris Sonnet 5.5 ca un complement mai rapid și mai ieftin pentru Claude Opus 5.5, pe care compania susține că este conceput pentru lucrări complexe ce necesită judecată atentă. Sonnet 5.5 excelează la sarcini cotidiene bine delimitate, la corectarea erorilor și la producerea de documente, prezentări și foi de calcul finisate, a declarat Anthropic, adăugând că are și un ochi fin pentru design.
Claude Sonnet 5.5 este disponibil pe toate platformele, inclusiv Amazon Web Services, Google Cloud și Microsoft Azure, sub ID-ul de model claude-sonnet-5-5, și este oferit cu zero retenție de date, la fel ca Opus 5.5 și Sonnet 5.
Rezultatele benchmark-urilor raportate
Anthropic raportează că Sonnet 5.5 obține 70,6 % la Terminal-Bench 4.0, o evaluare agentică de programare, comparativ cu 10,3 % pentru Sonnet 5, iar scorul listat pentru Opus 5.5 este de 66,4 % reflectând rezultatul său Xhigh. Pe setul principal al FrontierCode 1.1, Sonnet 5.5 înregistrează 46,2 % la efort Max și 52,1 % la Xhigh, comparativ cu 42,4 % pentru Sonnet 5, 54,4 % pentru Opus 5.5 și 49,3 % pentru GPT-6 Sol de la OpenAI. Scorurile raportate la CursorBench 4.0 sunt 55,5 % pentru Sonnet 5.5, 34,1 % pentru Sonnet 5 și 57,8 % pentru Opus 5.5.
În evaluările de lucru cunoaștere, compania raportează un scor GDPval-AA v2.1 de 1844 pentru Sonnet 5.5, cu două puncte sub 1846 al lui Opus 5.5 și aproximativ 400 de puncte peste 1449 al lui Sonnet 5, și un scor AA-Briefcase v1.1 de 1811 comparativ cu 1822 pentru Opus 5.5 și 1359 pentru Sonnet 5. Anunțul enumeră, de asemenea, 64,5 % cu instrumente la Humanity’s Last Exam, 80,1 % credit parțial la OSWorld 2.1 și 61,6 % fără instrumente la Chartography, un test de recunoaștere vizuală a diagramelor. Anthropic afirmă că Sonnet 5.5 este primul model Sonnet care depășește Pokémon Red lucrând doar din capturi de ecran.
Compania avertizează că scorurile benchmark reflectă doar o singură fațetă a capacităților unui model și spune că, în testele proprii și ale testerilor externi, Opus 5.5 rămâne evident mai puternic la lucrări complexe, deschise, ce necesită judecată susținută. O notă de subsol precizează că Artificial Analysis a rulat GDPval-AA și AA-Briefcase pe o implementare pre-lansare cu un bug la ieșirile structurate, care a fost corectat și ar subestima, dacă ceva, performanța lui Sonnet 5.5. O altă notă de subsol menționează că OpenAI a remediat recent un bug de înțelegere a imaginilor în GPT-6 Sol, pe care scorurile terților s-ar putea să nu le reflecte încă.
Rezultatele testerilor timpurii
Vicepreședintele AI al CodeRabbit, David Loker, a declarat că Sonnet 5.5 demonstrează o judecată mai bună decât Sonnet 5 la diferite niveluri de complexitate, consumând semnificativ mai puțini tokeni de ieșire, și că CodeRabbit intenționează să mute reviziile simple și moderate la acest model imediat, cu altele în săptămânile următoare. Liderul de inginerie AI la Base44, Gabriel Grinberg, a raportat că, în cele 118 construcții reale de aplicații, Sonnet 5.5 a înregistrat în medie 3,6 iterații pe construcție, comparativ cu 7,7 la Opus 5, având cele mai puține apeluri de instrumente eșuate dintre toate modelele comparate de Base44.
Inginerul principal la Slack, Curtis Allen, a raportat aproximativ cu 14 % mai puțini tokeni de ieșire în evaluările offline ale Slackbot fără modificări ale promptului. Directorul de AI al Zendesk, Abhinay Kathuria, a declarat că tichetele au fost procesate cu 20 % mai repede decât cu modelele Claude utilizate în producție de Zendesk. Balyasny Asset Management a raportat aproximativ 121 000 de tokeni pe răspuns, comparativ cu 497 000 ai Sonnet 5, pe o suită privată de 2 441 de sarcini financiare. Box a raportat rezultate de 2,4 ori mai rapide cu 12 % mai puțini tokeni în total, iar Atlassian a afirmat că clienții pot rula Rovo Agents cu până la 30 % mai repede decât cu Sonnet 5.
Prețuri, viteză și migrare
Prețurile listate pentru Sonnet 5.5 coincid exact cu cele ale Sonnet 5: 2 $ pentru un milion de tokeni de intrare, 10 $ pentru un milion de tokeni de ieșire, 0,20 $ pentru un milion de tokeni de citire din cache și 2,50 $ pentru un milion de tokeni de scriere în cache. Opus 5.5 are prețuri de 4 $ pentru intrare, 20 $ pentru ieșire și 5 $ pentru scrieri în cache. Anthropic afirmă că Sonnet 5.5 necesită de obicei mult mai puțini tokeni pentru aceeași muncă și este cel mai rapid model Sonnet de până acum.
Modelul oferă cinci niveluri de efort recalibrate: low, medium, high, xhigh și max. Valorile implicite sunt Medium în Claude Code și în aplicațiile Claude și High pe Claude Platform, care este, de asemenea, valoarea implicită a API-ului.
Anthropic’s ghid de migrare enumeră modificări semnificative pentru dezvoltatorii care trec de la Sonnet 5. Gândirea adaptivă rulează acum implicit, setarea de gândire dezactivată returnează o eroare 400, iar dezvoltatorii care au rulat Sonnet cu gândirea dezactivată trebuie să treacă la noua setare a instrumentelor, cea mai mică disponibilă, înainte de migrare. Alegerea forțată a instrumentului este respinsă în favoarea alegerii automate a instrumentului, asociată cu instrumente stricte, iar promptul minim cacheabil scade la 512 tokeni de la 1.024 la Sonnet 5. Documentația enumeră, de asemenea, cinci categorii de motive de refuz, acoperind cyber, bio, frontierllm, reasoningextracție și generalharms, și menționează că reîncercările de fallback pe server resping doar declinurile cyber și frontier_llm la Sonnet 5.
Constatări de siguranță și măsuri de protecție
Deoarece capabilitățile cibernetice ale Sonnet 5.5 sunt comparabile cu cele ale Opus 5, a declarat Anthropic, este primul model Sonnet lansat cu măsurile de protecție cibernetică și fallback-urile utilizate pe cele mai avansate modele ale companiei. Cartea carte de sistem raportează că, cu măsurile de protecție dezactivate, Sonnet 5.5 a înregistrat în medie 11.53 indicatoare de capacitate și o rată de captare de 80% pe ExploitBench și a produs 178 de exploatări complete de execuție de cod arbitrar, comparativ cu una pentru Sonnet 5. A finalizat 46.1% din provocările CyScenarioBench, comparativ cu 0.7% pentru Sonnet 5, și a produs 50 de deturnări ale fluxului de control în cadrul Binary Exploitation Benchmark, comparativ cu 3 pentru Sonnet 5.
Măsurile de protecție cibernetică funcționează în trei etape: un sondaj al activărilor interne ale modelului, un clasificator ușor pe model și un clasificator LLM antrenat separat. Cartea raportează o rată de reamintire de 99.43% pentru setul de acoperire a daunelor cibernetice și o rată de succes a atacului de 21.0% în evaluarea de rezistență rewind-attacker, îmbunătățită față de 57.2% pentru Sonnet 5, avertizând utilizatorii să se aștepte la refuzuri crescute chiar și în sarcini cibernetice benigne. Cererile cu risc mai mare revin vizibil la Sonnet 5, iar un Program extins de Verificare Cibernetică va oferi în curând apărătorilor verificați acces pe niveluri la capabilități avansate pe modelele Sonnet 5.5, Opus 5.5 și Claude Mythos.
Măsurile de protecție în biologie sunt aceiași clasificatori de utilizare dăunătoare implementați pentru Opus 5, fără model de rezervă, și Programul de Verificare în Științele Vieții al Anthropic acoperă accesul pentru întreaga gamă de activități biologice. Sonnet 5.5 este, de asemenea, primul model Sonnet cu clasificatori de siguranță care blochează extragerea raționamentului și extinde gândirea păstrată astfel încât gândirea unui model să nu poată fi decuplată de contul care l-a creat.
În cadrul auditului comportamental automatizat de aproximativ 1.850 de scenarii realizat de Anthropic, compania raportează că Sonnet 5.5 îmbunătățește sau egalează Sonnet 5 în majoritatea măsurilor de aliniere, rezistență la abuz și onestitate, înregistrează cea mai mică rată de încercări de evadare din sandbox dintre modelele testate și prezintă o gândire mai ilizibilă decât multe modele anterioare. Cartea de sistem afirmă că Sonnet 5.5 nu depășește noi praguri ale Politicii de Scalare Responsabilă, este considerat că îndeplinește pragurile CB-1 și Autonomy-1 ale politicii și prezintă un risc evaluat scăzut de nealiniere catastrofică. Data limită de cunoaștere fiabilă a modelului este iunie 2026.
Anthropic a declarat că Claude Haiku 5.5, conceput pentru aplicații cu volum mare și sensibilitate la cost, se va alătura familiei Claude 5.5 în săptămânile următoare.












