Моделі та платформи ШІ
Anthropic’s Opus 5 наближається до інтелекту фронтиру при ціні Opus

Anthropic випустив Claude Opus 5 24 липня 2026 року, представивши свою нову модель Opus-класу як повсякденного коня, який, згідно з власними оцінками компанії, наближається до інтелекту своєї більш дорогої моделі фронтиру, Fable 5, за половину ціни. Opus 5 доступний негайно на всіх додатках Anthropic, його API та основних хмарних платформах за 5 доларів за мільйон входних токенів і 25 доларів за мільйон виходових токенів, ті ж самі тарифи, що і модель, яку він замінив, Opus 4.8.
Запуск робить Opus 5 домівкою моделі на підписці Max від Anthropic і найсильнішою опцією, доступною на Pro. Компанія позиціонує його не як стелю можливостей, а як модель, налаштовану для щоденного використання, з налаштуванням зусиль, яке дозволяє розробникам обмінювати глибину розуміння на нижчу вартість токенів і швидшу відповідь.
Що показують бенчмарки Anthropic
За власними оцінками кодування та оцінками роботи з знаннями, Anthropic повідомляє, що Opus 5 є найкращим у галузі на тестах, включаючи Frontier-Bench і GDPval-AA, залишаючись позаду своєї обмеженої моделі Mythos 5 на завданнях кібербезпеки. Компанія заявляє, що Opus 5 більше ніж удвоє підвищує оцінку Opus 4.8 на Frontier-Bench при нижчій вартості за завдання, потрапляє в межі 0,5% від пікової оцінки Fable 5 на оцінці кодування CursorBench при максимальних зусиллях, витрачаючи половину вартості за завдання, і втричі перевищує результат наступної найкращої моделі на тесті ARC-AGI 3, тесті, побудованому навколо нових завдань, яких модель не бачила. На бенчмарку OSWorld комп’ютерного використання вона заявляє, що Opus 5 перевершує найкращий результат Fable 5 при витраті трохи понад одну третину ціни.
Anthropic описує стрибок як питання судження, а не сути оцінок. Вона описує тест, у якому Opus 5 отримала малюнок деталі машини, але не мала можливості переглянути зображення; модель написала свій власний комп’ютерний візуальний конвеєр, щоб витягнути геометрію з сирових пікселів і відновити деталь, завдання, яке, згідно з компанією, жодна конкуруюча модель не вирішила за п’ять спроб.
Це цифри, звітування виробника, отримані на власних тестових спорудах Anthropic, і жодна з них ще не була незалежно відтворена. Ця відмінність має значення більше, ніж зазвичай, тому що основний претензійний твердження полягає не в тому, що Opus 5 очолює таблицю лідерів, а в тому, що він забезпечує результати, близькі до фронтиру, за ціну середнього рівня. Єдина зовнішня перевірка, яку розкриває Anthropic, – це кібер-дослідження ранніх контрольних точок Opus 5 інститутом кібербезпеки Великої Британії, зазначене в системній картці моделі.
Заповнення прогалини в лінійці
Випуск закриває прогалину, яку сама Anthropic відкрила у своїй лінійці 2026 року. Sonnet 5, випущений 30 червня 2026 року, забезпечував роботу майже на рівні Opus за частину ціни, тоді як модель класу Mythos Fable 5, випущена 9 червня 2026 року, розташовувалася над Opus у два рази дорожче. Це залишило рівень Opus стиснутим з обох сторін. Opus 5 надає клієнтам Max, Team і Enterprise варіант, близький до фронтиру, без оплати за тарифи Fable або Mythos.
Для команд, які виконують тривалі агентські завдання, вартість за виконане завдання має значення більше, ніж ціна за токен, і Anthropic спирається на цю математику. Вона заявляє, що Opus 5 завершує роботу за меншу кількість кроків і з меншою кількістю викликів інструментів, ніж Opus 4.8, і пропонує режим Fast, який працює приблизно в 2,5 рази швидше за замовчуванням за подвійну базову ціну.
Безпека та застереження в системній картці
Системна картка Anthropic Opus 5 називає Opus 5 найбільш узгодженою моделлю на сьогодні згідно з автоматизованим поведінковим аудитом компанії, набираючи очки попереду Sonnet 5, Opus 4.8 і моделі фронтиру Fable 5 за дотримання своєї моделей конституції, з найнижчою швидкістю співробітництва з неправильним використанням будь-якої з моделей, які вона протестувала. Це самооцінка з внутрішнього аудиту Anthropic, а не зовнішні висновки.
Той самий документ надзвичайно відкрито говорить про обмеження моделі. Він зазначає, що Opus 5 “галлюцинує фактичні твердження трохи більше, ніж Opus 4.8, незважаючи на загальну точність”, і що вона відстає від Mythos 5 як у біологічних дослідженнях, так і в агресивній кібербезпеці. У одному внутрішньому біологічному тренуванні модель багаторазово застрявала в само-перевірочних циклах і не змогла надати набір проектів білків, яких завершив Mythos 5.
У питаннях кібер-захисту Anthropic змоделювала класифікатори Opus 5 на основі Fable 5, але очікує, що вони втрутяться приблизно на 85% менше часто. Модель тепер дозволена для пошуку уразливостей у вихідному коді, робота, яка нахилена до оборони, тоді як сканування скомпільованих бінарних файлів, тестування на проникнення та генерація експлойтів залишаються заблокованими. Запити, які спрацьовують класифікатор, повертаються до Opus 4.8 за замовчуванням. На відміну від Fable і Mythos, Opus 5 не має жодного вимогу щодо збереження даних для загального доступу.
Практичний тест тепер полягає в тому, чи незалежні оцінювачі відтворюють кодування та здобутки розуміння, які повідомляє Anthropic, і чи покращення узгодженості витримують поза власним аудитом компанії. До тих пір, найяснішою річчю, яку змінює Opus 5, є ціна можливостей, близьких до фронтиру, у власному каталозі Anthropic.












