Модели и платформы ИИ
Релиз Opus 5 от Anthropic: приближение к интеллекту фронтира по цене Opus

Компания Anthropic выпустила Claude Opus 5 24 июля 2026 года, представив свою новую модель Opus-класса как повседневного работника, который, по заявлению компании, приближается к интеллекту своей более дорогой модели фронтира, Fable 5, при этом стоимостью вдвое ниже. Opus 5 доступен сразу во всех приложениях Anthropic, в ее API и на основных облачных платформах по цене $5 за миллион входных токенов и $25 за миллион выходных токенов, по тем же тарифам, что и модель, которую она заменяет, Opus 4.8.
Запуск делает Opus 5 моделью по умолчанию в подписке Anthropic Max и самой мощной опцией, доступной в Pro. Компания позиционирует его не как потолок возможностей, а как модель, настроенную для ежедневного использования, с настройкой усилий, которая позволяет разработчикам обменять глубину рассуждений на более низкую стоимость токенов и более быстрые ответы.
Что показывают бенчмарки Anthropic
По собственным оценкам кодирования и знаний, компания Anthropic сообщает, что Opus 5 является лучшим на тестах, включая Frontier-Bench и GDPval-AA, при этом отставая от своей ограниченной модели Mythos 5 на задачах кибербезопасности. Компания заявляет, что Opus 5 более чем удваивает результат Opus 4.8 на Frontier-Bench при более низкой стоимости за задачу, достигает уровня 0,5% от пика Fable 5 на оценке кодирования CursorBench при максимальных усилиях, при этом стоимостью вдвое ниже за задачу, и в три раза превышает результат следующей лучшей модели на тесте ARC-AGI 3, который построен вокруг новых проблем, с которыми модель не сталкивалась. На бенчмарке OSWorld компания заявляет, что Opus 5 превосходит лучший результат Fable 5 при стоимости чуть более трети.
Anthropic представляет этот скачок как вопрос суждения, а не сырых баллов. Она описывает тест, в котором Opus 5 получил рисунок детали машины, но не имел возможности просмотреть изображение; модель написала свой собственный компьютерный алгоритм зрения, чтобы извлечь геометрию из сырых пикселей и восстановить деталь, задачу, которую, по заявлению компании, ни одна конкурирующая модель не решила за пять попыток.
Это цифры, сообщенные поставщиком, полученные на собственных тестовых площадках Anthropic, и пока ни одна из них не была независимо воспроизведена. Это различие имеет значение больше, чем обычно, потому что основной заявленный претензия заключается не в том, что Opus 5 возглавляет таблицу лидеров, а в том, что он обеспечивает результаты, близкие к фронтиру, по цене среднего уровня. Единственная внешняя проверка, о которой Anthropic сообщает, – это тестирование кибер-дикой среды ранних контрольных точек Opus 5 британским Институтом безопасности ИИ, сообщаемый в системной карте модели.
Заполнение пробела в линейке
Выпуск заполняет пробел, который Anthropic открыла в своей собственной линейке 2026 года. Sonnet 5, выпущенный 30 июня 2026 года, обеспечил работу, близкую к Opus, по доле стоимости, в то время как модель Mythos-класса Fable 5, выпущенная 9 июня 2026 года, стояла выше Opus по цене вдвое выше. Это оставило уровень Opus сжатым с обеих сторон. Opus 5 дает клиентам Max, Team и Enterprise возможность получить результаты, близкие к фронтиру, не платя по ставкам Fable или Mythos.
Для команд, которые выполняют длинные агентные рабочие нагрузки, стоимость за выполненную задачу имеет значение больше, чем цена за токен, и Anthropic опирается на эту математику. Она заявляет, что Opus 5 завершает работу за меньшее количество шагов и с меньшим количеством вызовов инструментов, чем Opus 4.8, и предлагает режим Fast, который работает примерно в 2,5 раза быстрее базовой скорости при двойной базовой цене.
Безопасность и оговорки в системной карте
Системная карта Anthropic Opus 5 называет Opus 5 своей наиболее согласованной моделью на сегодняшний день по автоматизированному поведенческому аудиту компании, опережая Sonnet 5, Opus 4.8 и модель фронтира Fable 5 по соблюдению модели конституции, с самой низкой скоростью сотрудничества с злоупотреблением любой проверенной ею моделью. Это самооценки из внутреннего аудита Anthropic, а не внешние результаты.
Тот же документ необычно откровенен о ограничениях модели. Он отмечает, что Opus 5 “галлюцинирует фактические утверждения немного больше, чем Opus 4.8, несмотря на то, что является более точным в целом”, и что он отстает от Mythos 5 как в биологических исследованиях, так и в офенсивной кибербезопасности. В одном внутреннем биологическом упражнении модель повторно застревала в петлях само-проверки и не смогла предоставить набор проектов белков, которые Mythos 5 завершил.
В отношении кибер-гарантий Anthropic смоделировала классификаторы Opus 5 по образцу Fable 5, но ожидает, что они будут вмешиваться примерно на 85% реже. Модель теперь разрешена для поиска уязвимостей в исходном коде, работы, которая имеет оборонительный уклон, в то время как сканирование собранных бинарных файлов, тестирование на проникновение и генерация эксплойтов остаются заблокированными. Запросы, которые вызывают классификатор, по умолчанию откатываются до Opus 4.8. В отличие от Fable и Mythos, Opus 5 не несет требований к хранению данных для общего доступа.
Практический тест теперь заключается в том, чтобы определить, воспроизведут ли независимые оценщики прирост кодирования и рассуждений, который Anthropic сообщает, и будут ли улучшения согласованности сохраняться вне аудита компании. До тех пор, пока яснее всего, что Opus 5 меняет цену gần-фронтирной возможности в собственном каталоге Anthropic.












