Modele i platformy AI
Opu 5 Anthropic zbliża się do granicy wydajności przy cenach Opus

Firma Anthropic wydała Claude Opu 5 w dniu 24 lipca 2026 r., przedstawiając swój najnowszy model Opus jako codzienny koń, który, według samej firmy, zbliża się do wydajności znacznie droższego modelu granicznego, Fable 5, przy połowie kosztu. Opu 5 jest dostępny natychmiast we wszystkich aplikacjach Anthropic, jego API oraz głównych platformach chmurowych, za 5 dolarów za milion tokenów wejściowych i 25 dolarów za milion tokenów wyjściowych, te same stawki co model, który zastępuje, Opu 4.8.
Uruchomienie sprawia, że Opu 5 staje się domyślnym modelem na subskrypcji Max Anthropic i najsilniejszą opcją dostępną na Pro. Firma przedstawia go raczej jako model dostosowany do codziennego użytku, z ustawieniem wysiłku, które pozwala deweloperom wymienić głębokość rozumowania na niższy koszt tokenów i szybsze odpowiedzi.
Czego dowodzą testy Anthropic
Własne oceny kodowania i pracy wiedzy Anthropic pokazują, że Opu 5 jest na poziomie stanu techniki w testach, w tym Frontier-Bench i GDPval-AA, podczas gdy pozostaje za modelem Mythos 5 w zadaniach związanych z cyberbezpieczeństwem. Firma twierdzi, że Opu 5 podwaja wynik Opu 4.8 w teście Frontier-Bench przy niższych kosztach na zadanie, osiąga wynik w granicach 0,5% od maksymalnego wyniku Fable 5 w teście kodowania CursorBench przy maksymalnym wysiłku, przy jednocześnie niższych kosztach na zadanie, i potraja wynik najlepszego modelu w teście ARC-AGI 3, teście opartym na nowych problemach, których model nie widział. W teście OSWorld dotyczącym użycia komputera, twierdzi, że Opu 5 bije najlepszy wynik Fable 5 przy kosztach mniejszych niż jedną trzecią.
Anthropic przedstawia ten skok jako kwestię oceny, a nie surowych wyników. Opisuje test, w którym Opu 5 otrzymał rysunek części maszyny, ale nie miał możliwości wyświetlenia obrazu; model napisał własny potok widzenia komputera, aby pobrać geometrię z surowych pikseli i odtworzyć część, zadanie, które firma twierdzi, że żaden konkurujący model nie rozwiązał w pięciu próbach.
To są dane podane przez samego producenta, uzyskane na własnych urządzeniach testowych, i żadne z nich nie zostało jeszcze niezależnie potwierdzone. Ta różnica jest ważniejsza niż zwykle, ponieważ główny wniosek nie polega na tym, że Opu 5 zajmuje pierwsze miejsce na liście rankingowej, ale że dostarcza wyniki graniczne przy cenie średniej. Jedyną zewnętrzną weryfikacją, o której Anthropic informuje, jest testowanie w cyberprzestrzeni wczesnych punktów kontrolnych Opu 5 przez Instytut Bezpieczeństwa AI w Wielkiej Brytanii, opisany w karcie systemowej modelu.
Wypełnienie luki w ofercie
Wydaanie zamyka lukę, którą Anthropic otworzył we własnej ofercie na 2026 rok. Sonnet 5, wydany 30 czerwca 2026 r., dostarczał wyniki zbliżone do poziomu Opu przy ułamku kosztu, podczas gdy model Fable 5 z klasy Mythos, wydany 9 czerwca 2026 r., znajdował się powyżej Opu przy podwójnym koszcie. To pozostawiło poziom Opu ściskany z obu stron. Opu 5 daje klientom Max, Team i Enterprise opcję graniczną bez konieczności płacenia cen Fable lub Mythos.
Dla zespołów wykonujących długie zadania agenty, koszt na zadanie ma większe znaczenie niż cena wyświetlana na token, i Anthropic opiera się na tej matematyce. Twierdzi, że Opu 5 kończy zadania w mniejszej liczbie kroków i z mniejszą liczbą wywołań narzędzi niż Opu 4.8, i oferuje tryb Szybki, który działa około 2,5 razy szybciej niż domyślny przy podwójnej cenie podstawowej.
Bezpieczeństwo i zastrzeżenia w karcie systemowej
Karta systemowa Anthropic Opus 5 określa Opu 5 jako najbardziej wyśrodkowany model do tej pory, zgodnie z automatycznym audytem behawioralnym firmy, z wynikiem wyższym niż Sonnet 5, Opu 4.8 i graniczny model Fable 5 w zakresie przestrzegania konstytucji modelu, z najniższym wskaźnikiem współpracy z nadużyciami spośród wszystkich przetestowanych modeli. To są samooceny z wewnętrznego audytu Anthropic, a nie zewnętrzne ustalenia.
Ten sam dokument jest niezwykle otwarty o ograniczeniach modelu. Zauważa, że Opu 5 “halucynuje twierdzenia faktograficzne nieco bardziej niż Opu 4.8, pomimo ogólnej większej dokładności”, i że pozostaje w tyle za modelem Mythos 5 zarówno w badaniach biologicznych, jak i cyberbezpieczeństwie ofensywnym. W jednym wewnętrznym ćwiczeniu biologicznym model wielokrotnie utknął w pętlach samoweryfikacji i nie zdołał dostarczyć zestawu projektów białkowych, których Mythos 5 ukończył.
W odniesieniu do zabezpieczeń cybernetycznych, Anthropic opracował klasyfikatory Opu 5 na podstawie Fable 5, ale oczekuje, że będą one interweniować o około 85% rzadziej. Model jest teraz dopuszczony do wyszukiwania luk w zabezpieczeniach w kodzie źródłowym, pracy, która nachylona jest ku obronie, podczas gdy skanowanie skompilowanych binariów, testy penetracyjne i generowanie eksploatacji pozostają zablokowane. Żądania, które wyzwala klasyfikator, domyślnie przechodzą do Opu 4.8. W przeciwieństwie do Fable i Mythos, Opu 5 nie ma wymogu przechowywania danych dla ogólnego dostępu.
Praktycznym testem jest teraz, czy niezależni ewaluatorzy odtworzą korzyści kodowania i rozumowania, o których Anthropic informuje, oraz czy poprawki wyrównania będą utrzymane poza własnym audytem firmy. Do tego czasu najbardziej oczywistą rzeczą, którą Opu 5 zmienia, jest cena możliwości granicznych w własnym katalogu Anthropic.












