Modele și platforme AI

Lansarea Opus 5 de la Anthropic se apropie de inteligența de frontieră la prețurile Opus

mm
Adaugă Unite.AI la sursele tale preferate pe Google
A person at a desk at night reading a long streaming reply in a warm-toned AI assistant chat interface, with a two-bar capability-versus-cost chart glowing on a second screen.

Anthropic a lansat Claude Opus 5 pe 24 iulie 2026, prezentându-și noul model Opus-class ca un cal de lucru de zi cu zi care, potrivit companiei, se apropie de inteligența modelului său mai scump, Fable 5, la jumătate de preț. Opus 5 este disponibil imediat pe aplicațiile Anthropic, API-ul și principalele platforme de cloud, la 5 dolari pe milion de tokeni de intrare și 25 de dolari pe milion de tokeni de ieșire, aceleași tarife ca și modelul pe care îl înlocuiește, Opus 4.8.

Lansarea face din Opus 5 modelul implicit pe abonamentul Max al Anthropic și opțiunea cea mai puternică disponibilă pe Pro. Compania îl prezintă mai puțin ca o limită a capacității, ci ca un model adaptat pentru utilizare zilnică, cu un setare de efort care permite dezvoltatorilor să facă schimb între profunzimea raționamentului și costul mai mic al tokenilor și răspunsuri mai rapide.

Ce arată benchmark-urile Anthropic

În evaluările sale proprii de codare și muncă de cunoaștere, Anthropic raportează că Opus 5 este de ultimă generație pe teste care includ Frontier-Bench și GDPval-AA, în timp ce rămâne în urma modelului său restricționat Mythos 5 pe sarcini de securitate cibernetică. Compania spune că Opus 5 depășește de peste două ori scorul Opus 4.8 pe Frontier-Bench la un cost mai mic pe sarcină, ajunge la 0,5% de vârful Fable 5 pe evaluarea de codare CursorBench la efort maxim, în timp ce costă jumătate mai puțin pe sarcină, și triplează rezultatul modelului următor pe ARC-AGI 3, un test construit în jurul problemelor noi pe care modelul nu le-a văzut. Pe benchmark-ul OSWorld de utilizare a calculatorului, spune că Opus 5 depășește cel mai bun rezultat al Fable 5 la aproximativ o treime din cost.

Anthropic prezintă saltul ca o chestiune de judecată, mai degrabă decât scoruri brute. Descrie un test în care Opus 5 a primit o desenare a unei piese de mașină, dar fără nicio modalitate de a vizualiza imaginea; modelul a scris o pipelină de viziune computerizată pentru a extrage geometria din pixelii bruti și a reconstrui piesa, o sarcină pe care compania spune că niciun model concurent nu a rezolvat-o în cinci încercări.

Acestea sunt cifre raportate de vendor, rulate pe harness-urile proprii ale Anthropic, și niciuna nu a fost încă replicată în mod independent. Această distincție contează mai mult decât de obicei aici, pentru că afirmația principală nu este că Opus 5 se situează în fruntea unui clasament, ci că oferă rezultate apropiate de frontieră la un preț de nivel mediu. Singurul control extern pe care Anthropic îl dezvăluie este testarea de către Institutul de Securitate AI din Regatul Unit a punctelor de control Opus 5 timpurii, raportate în fișa de sistem a modelului.

Umplerea unei lacune în gamă

Lansarea astupă o gaură pe care Anthropic și-o deschisese în propria sa gamă din 2026. Sonnet 5, lansat pe 30 iunie 2026, a oferit rezultate apropiate de nivelul Opus la o fracțiune din preț, în timp ce modelul Mythos-class Fable 5, lansat pe 9 iunie 2026, a stat deasupra Opus la dublul prețului. Acest lucru a lăsat nivelul Opus strâns din ambele părți. Opus 5 oferă clienților Max, Team și Enterprise o opțiune apropiată de frontieră fără a plăti tarifele Fable sau Mythos.

Pentru echipele care rulează sarcini agențice pe termen lung, costul pe sarcină finalizată are tendința de a conta mai mult decât prețul de listă pe token, și Anthropic se sprijină pe această matematică. Spune că Opus 5 finalizează sarcinile în mai puține etape și cu mai puține apeluri de unelte decât Opus 4.8, și oferă un mod Rapid care rulează aproximativ de 2,5 ori viteza implicită la dublul prețului de bază.

Siguranță și rezervele din fișa de sistem

Fișa de sistem a lui Anthropic Opus 5 îl numește pe Opus 5 modelul său cel mai aliniat până în prezent pe auditul său comportamental automatizat, scorând înaintea Sonnet 5, Opus 4.8 și modelului de frontieră Fable 5 în ceea ce privește respectarea constituției modelului, cu cea mai mică rată de cooperare cu utilizarea abuzivă a oricărui model testat. Acestea sunt autoevaluări din partea auditului intern al Anthropic, nu descoperiri externe.

Același document este neobișnuit de deschis cu privire la limitele modelului. Notează că Opus 5 “halucinează afirmații factuale puțin mai mult decât Opus 4.8, în ciuda faptului că este mai precis în general”, și că se situează în urma Mythos 5 atât în cercetarea biologică, cât și în securitatea cibernetică ofensivă. Într-un exercițiu intern de biologie, modelul a rămas blocat în bucle de auto-verificare și nu a reușit să livreze un set de proiecte de proteine pe care Mythos 5 le-a finalizat.

În ceea ce privește gardurile cibernetice, Anthropic a modelat clasificatorii Opus 5 pe cei ai Fable 5, dar se așteaptă ca aceștia să intervină de aproximativ 85% mai puțin. Modelul este acum autorizat să caute vulnerabilități în codul sursă, o muncă care se îndreaptă spre apărare, în timp ce scanarea binarelor compilate, testarea de penetrare și generarea de exploatare rămân blocate. Solicitările care declanșează un clasificator revin la Opus 4.8 în mod implicit. În contrast cu Fable și Mythos, Opus 5 nu are nicio cerință de reținere a datelor pentru accesul general.

Testul practic acum este dacă evaluatorii independenți reproduc câștigurile de codare și raționament pe care Anthropic le raportează și dacă îmbunătățirile de aliniere se mențin în afara auditului propriu al companiei. Până atunci, cel mai clar lucru pe care Opus 5 îl schimbă este prețul capacității apropiate de frontieră în catalogul propriu al Anthropic.

Jonas Reeve este un analist generat de AI la Unite.AI, concentrându‑se pe inteligența cognitivă AI, inteligența artificială generală (AGI) și fundamentele teoretice ale inteligenței mașinilor. Munca sa explorează modul în care învățarea, raționamentul, memoria și abstractizarea apar atât în sistemele biologice, cât și în cele artificiale, stabilind legături între arhitecturile moderne de AI și întrebările de lungă durată din știința cognitivă și filosofia minții.

Printr‑o abordare conceptuală și reflexivă, Jonas examinează cadre precum modele de raționament, sisteme agențiale, cogniție emergentă și teoria aliniamentului, vizând să clarifice ce înseamnă cu adevărat progresul către AGI — și ce nu înseamnă. În loc să urmărească termene limită sau hype‑ul, el pune accent pe principii de bază, rigurozitate conceptuală și limitele modelelor actuale.

Articolele scrise de Jonas Reeve sunt generate de AI și revizuite de echipa editorială a Unite.AI pentru a asigura acuratețea, claritatea și discuția responsabilă a conceptelor avansate de AI.