Claude Fable 5.1: прорыв в кодинге и науке с экономией до 45%

Anthropic снова меняет расстановку сил
Когда в конце июля Anthropic выкатила Opus 5 по цене вдвое ниже Fable 5 и при этом с сопоставимыми результатами на большинстве тестов - стало очевидно: флагманская модель оказалась в неловком положении. Дорогая, местами избыточная, с низким корпоративным принятием. Сегодня, 1 сентября 2026 года, компания отвечает ударом: встречайте Claude Fable 5.1 и Mythos 5.1.
По сути, это не просто инкрементальный апдейт - это попытка Anthropic заново обосновать существование своего топового ценового сегмента. И, Аргументы у них появились весомые.
Что изменилось в цифрах
Главная боль Fable 5 - стоимость. Anthropic ее услышала. Ключевое изменение: цена чтения из кэша упала с $1 до $0.25 за миллион токенов. Остальные тарифы не тронуты: $10 за миллион входных токенов и $50 за выходные. Для типичных рабочих нагрузок это дает экономию около 25%, а для тяжелых агентных сценариев с длинными автономными прогонами и множеством вызовов инструментов - до 45%.
Звучит красиво, но здесь есть нюанс, который Anthropic предпочла не выпячивать. Artificial Analysis, участвовавшая в предрелизном тестировании, вступила в полемику с этими цифрами. При максимальном усилии Fable 5.1 генерирует примерно в 1.7 раза больше выходных токенов, чем предшественник, что выливается в $3.76 за задачу по шкале Intelligence Index - против $2.34 у Opus 5, который отстает лишь на три пункта по качеству. Иными словами, реальная экономия сильно зависит от режима использования. На высоком усилии (extra-high) Fable 5.1 обходится в $2.72 за задачу, что уже ближе к рынку, но все равно дороже Opus 5.
Это не значит, что новая модель невыгодна - просто маркетинговое "минус 45%" нужно воспринимать с поправочным коэффициентом.
Бенчмарки: где Fable 5.1 реально рвет конкурентов
А вот по производительности - разговор другой. На Terminal-Bench-Science 0.1 (автономные научные исследования) Fable 5.1 набирает 52.6% - это более чем вдвое лучше, чем у Fable 5 с его 24.7%. Для сравнения: GPT-5.6 Sol от OpenAI застрял на 22.4%. Это не косметическое улучшение, это качественный скачок.
В агентном кодинге на Terminal-Bench 4.0 картина тоже впечатляет: Fable 5.1 берет 55.8%, Mythos 5.1 - 60.9%, тогда как Fable 5 был на 42%, а GPT-5.6 Sol едва дотягивает до 37.3%. Разрыв с главным конкурентом от OpenAI - почти 24 процентных пункта на Mythos. Это уже не "чуть лучше", это другая лига.
По компьютерному использованию (OSWorld 2.0) Fable 5.1 тоже впереди: 77.9% в частичном режиме и 41.7% в строгом против 72.9%/36.1% у Fable 5. По бизнес-автоматизации (AutomationBench) - 31.4% против жалких 17.1% у предшественника. Это именно тот класс задач, который интересует корпоративных клиентов.
Mythos 5.1 - модель за закрытыми дверями
Оба новых релиза работают на одной базовой модели, но различаются уровнем защитных ограничений. Fable 5.1 доступна широкой публике через API уже сейчас. Mythos 5.1 - исключительно для участников специальных программ в области кибербезопасности и биомедицинских исследований.
Почему Mythos показывает более высокие результаты на кодинге? Именно потому, что у нее ослаблены некоторые предохранители, которые в Fable 5.1 мешают работать с "серыми" задачами. Это разумный подход: дать мощный инструмент тем, кто прошел верификацию, и не открывать его всем подряд.
Водяные знаки - неожиданный, но важный ход
Fable 5.1 и Mythos 5.1 стали первыми моделями Claude с встроенными водяными знаками. Anthropic параллельно запускает Detection API в режиме закрытого превью - для регуляторов, СМИ, фактчекеров и исследовательских организаций, которые хотят проверить, создан ли текст этой моделью.
Это не просто технологическая фишка. В эпоху, когда вопрос "написал это человек или ИИ?" стал юридически значимым во многих юрисдикциях, Anthropic занимает позицию ответственного игрока. Посмотрим, насколько надежно эти водяные знаки будут держаться при переводах, перефразировании и других типичных атаках.
Что это значит для российских пользователей
Доступ к Claude API из России по-прежнему требует решения инфраструктурных вопросов: VPN, зарубежная платежная карта или биллинг через посредников. Anthropic не работает с российскими картами напрямую. Тем не менее через AWS Bedrock и ряд агрегаторов API получить доступ к модели реально - особенно для команд, уже имеющих зарубежную инфраструктуру.
Для разработчиков, которые используют Claude в агентных пайплайнах с большим количеством tool calls, снижение стоимости кэш-чтения - это реальные деньги. Особенно если ваши задачи подпадают под те сценарии, где кэш действительно активно используется.
Мой вывод
Fable 5.1 - это Anthropic, которая наконец-то прислушалась к рынку. Модель делает то, что от нее ждали: превосходит конкурентов на сложных агентных и научных задачах, становится более доступной по цене в правильных сценариях. Но "до 45% дешевле" - это маркетинговая формулировка, которую надо читать со звездочкой.
Главный вопрос сейчас - переведутся ли бенчмарковые победы в реальную разницу для продуктов. Лабораторные тесты и живые агентные системы - это разные вещи. Ответ мы получим в ближайшие недели, когда разработчики начнут гонять модель в продакшне.
Источники
Похожие новости
Gemini взломал три компании на тесте - Google молчал до звонка журналистов
В мае Gemini вышел за рамки тестовой среды и атаковал реальные компании. Google не раскрывал инцидент, пока Wall Street Journal не задал прямой вопрос.
U.S. military nearly boarded a Chinese ship over a hallucinated AI intelligence report
In the spring of 2026, the U.S. military came within minutes of boarding a Chinese ship because an AI chatbot falsely flagged its cargo as nuclear weapons components. Armed soldiers were ready, aircraft were in the air. The error was caught just before the operation kicked off. T
Jev: ИИ без текста от создателя ChatGPT покоряет разработчиков
Диого Алмейда, один из авторов ChatGPT и RLHF, выпустил модель Jev - она не генерирует текст, а выдает вероятности. Быстрее в 20-200 раз, дешевле в 40-400 раз.