Anthropic запустила Claude Opus 5: мощнее Fable, вдвое дешевле

Тихая революция с громкими цифрами
Антропик снова переписала правила игры, только на этот раз без привычного фанфарного шума. 24 июля 2026 года компания выкатила Claude Opus 5 — модель, которая формально считается «меньшей», чем Fable 5, но на деле обставляет его на целом ряде практических задач. Это тот редкий случай, когда маркетинговая иерархия расходится с реальной производительностью.
Два месяца назад, 28 мая, появился Opus 4.8 — и вот уже следующая итерация. Темп разработки у Anthropic сейчас такой, что следить за версиями сложнее, чем за обновлениями iOS.
Что внутри: цифры, которые важны
Начнём с главного. На Frontier-Bench v0.1 Opus 5 обходит все существующие модели — включая Fable 5 и Mythos 5. На ARC-AGI 3, тесте на решение принципиально новых задач, Opus 5 набирает втрое больше, чем ближайший конкурент. Это не опечатка.
На CursorBench 3.2 модель при максимальных усилиях отстаёт от пика Fable 5 менее чем на 0,5% — но при этом стоит вдвое дешевле. На OSWorld 2.0, бенчмарке по управлению компьютером, Opus 5 превосходит лучший результат Fable 5 при затратах чуть больше трети от стоимости последнего.
На Zapier AutomationBench — реальные бизнес-задачи от начала до конца — Opus 5 выполняет задачи с коэффициентом примерно в 1,5 раза выше, чем следующая лучшая модель при том же бюджете на токены. Даже на минимальных настройках усилий он обходит все остальные модели.
Отдельного внимания заслуживает прогресс в науке. В задачах органической химии — например, вывод молекулярной структуры из спектроскопических данных — Opus 5 прибавил 10,2 процентных пункта по сравнению с Opus 4.8. В задачах предсказания функций белков — ещё 7,7 п.п. Для биоинформатиков и хим-исследователей это уже не игрушка, а рабочий инструмент.
Агентность нового уровня
Anthropicделает ставку на «агентную» работу — способность модели не просто отвечать, а доводить задачи до конца самостоятельно. И здесь Opus 5 демонстрирует что-то по-настоящему впечатляющее.
В одном из тестов Frontier-Bench модели дали чертёж детали машины и попросили воссоздать её в виде 3D-модели FreeCAD — при этом намеренно лишив прямого доступа к изображению. Opus 5 написал собственный пайплайн компьютерного зрения, извлёк геометрию из пикселей и восстановил деталь. Повторял это несколько раз подряд. Ни одна конкурирующая модель с той же задачей не справилась даже с пяти попыток.
В другом примере Opus 5 нашёл баг в популярном пакетном менеджере с открытым кодом — и не просто воспроизвёл патч сообщества, а обнаружил граничный случай, который тот патч пропустил. Это уже уровень senior-разработчика.
Ограничения ослаблены — и это важнее, чем кажется
Fable 5 с момента выхода раздражал разработчиков избыточной осторожностью классификаторов безопасности. Opus 5 существенно меняет картину: Anthropic заявляет, что их срабатывание снизится на 85% по сравнению с Fable 5. Это колоссальная разница в повседневной работе.
Как и предшественник, Opus 5 не подпадает под политику хранения данных 30 дней, которая распространяется на Fable и Mythos. Для компаний с требованиями к конфиденциальности это принципиально.
При этом Anthropic не отказалась от разумных ограничений. Opus 5 не будет сканировать уязвимости в бинарных файлах — но может работать с исходным кодом, поскольку это чаще используется для защитных целей. Логика понятна и оправдана.
Ещё одна новинка — функция Automatic Fallbacks в бета-версии. Если запрос всё же срабатывает на классификатор безопасности, система автоматически перенаправляет его к менее мощной модели вместо того, чтобы возвращать ошибку. API-разработчики оценят: вместо обрыва — деградированный, но рабочий ответ.
Где это работает и сколько стоит
Opus 5 стал моделью по умолчанию в Claude Max и сильнейшей моделью в Claude Pro. Цена — на уровне Opus 4.8, то есть при значительно лучшей производительности. Для российских пользователей ситуация привычная: прямой доступ через claude.ai требует VPN и нероссийской карты, API — тоже. Ничего принципиально нового здесь нет.
Что это значит для рынка
Llama 4, GPT-4.5, Gemini 2.5 Pro — все они сейчас смотрят на бенчмарки Opus 5 с нескрытым дискомфортом. Особенно болезненно выглядит сравнение с Fable 5: Anthropic фактически создала модель, которая в большинстве практических задач превосходит собственный флагман за половину цены.
Остаётся единственный пробел в линейке — Haiku 5 так и не вышел. Все остальные модели пятого поколения (Mythos, Fable, Sonnet) дебютировали ещё в июне. Лёгкая модель для быстрых задач всё ещё ждёт своей очереди.
Мой вывод прост: если вы сейчас выбираете основную модель для продакшн-проекта, Opus 5 — это очевидный выбор в 90% случаев. Fable 5 имеет смысл только там, где критически важны задачи кибербезопасности, где Mythos 5 по-прежнему лидирует. В остальном — Opus 5 дешевле, умнее в агентных задачах и значительно меньше мешает работе своими ограничениями.
Информация о запуске подтверждена несколькими независимыми публикациями.
Источники
Похожие новости
OpenAI распустила команду по катастрофическим рискам ИИ
OpenAI тихо ликвидировала отдел Preparedness, который оценивал угрозы от собственных моделей. Сотрудники говорят о нарастающем «чувстве тревоги и ответственности».
Optima: бенчмарки ИИ наконец-то на ваших реальных данных
Artificial Analysis запустила платформу Optima, которая позволяет строить персональные бенчмарки для LLM на основе собственных данных и сравнивать модели не только по качеству, но и по стоимости задачи.
ИИ-книги затопили Amazon и режут доходы живых авторов
Исследование 14 000 книг показало: ИИ-контент занял 20% каталога, но забирает лишь 12% выручки — зато тянет вниз доходы всех авторов без исключения.