Anthropic
ИИ-чатClaude Opus 5.5AnthropicGPT-6 AstraLLMбенчмарки

Claude Opus 5.5: на 40% дешевле и без фирменной "клодовщины"

Сергей Сергеев, редактор gen-hub.ru
Сергей Сергеев
Редактор gen-hub.ru
·4 мин чтения
Claude Opus 5.5: на 40% дешевле и без фирменной "клодовщины"

Anthropic тихо, но уверенно делает ход, который заставит конкурентов пересчитать свои прайс-листы. Claude Opus 5.5 - первая модель нового семейства 5.5 - выходит с обещанием, которое на рынке ИИ звучит почти революционно: меньше платишь, получаешь столько же, а то и больше.

Цифры, которые говорят сами за себя

Сравним напрямую. Opus 5 стоил $5 за миллион входящих токенов и $25 за исходящие. Opus 5.5 - $4 и $20 соответственно. Чтение кэша подешевело с $0.50 до $0.20 за миллион - то есть на 60%. Anthropic утверждает, что совокупные эксплуатационные расходы упадут примерно на 40% - не только из-за снижения цен, но и потому что модель банально расходует меньше токенов на те же задачи и работает на 30% быстрее предшественника.

Для компаний, которые гоняют через API тысячи запросов ежедневно, это разница не в процентах, а в реальных деньгах в конце месяца. Финансовые сервисы, юридические фирмы, команды разработки - аудитория, на которую Anthropic явно и прицеливается.

Бенчмарки: где Opus 5.5 выигрывает, а где нет

Anthropic опубликовала сравнительную таблицу, и она весьма показательна. На Terminal-Bench 4.0 - одном из самых сложных тестов агентного кодинга - Opus 5.5 набирает 66.4% против 57.9% у GPT-6 Astra и 55.8% у Fable 5.1. На FrontierCode v1.1 картина похожая: 54.4% против 53.3% у Astra. На CursorBench 4.0 модель набирает 57.8%, тогда как у Astra данных нет вовсе - OpenAI просто не тестировала там свою флагманскую модель.

На Humanity's Last Exam - тесте на мультидисциплинарное рассуждение, который принято считать одним из самых честных индикаторов реального интеллекта - Opus 5.5 дает 67.7% с инструментами. GPT-6 Astra остановился на 57.2%. Разрыв в 10 процентных пунктов - это уже не статистический шум.

Но есть нюанс. На AutomationBench для бизнес-процессов GPT-6 Astra набирает 41.4%, а Opus 5.5 - 40.0%. Разница крошечная, и тут Anthropic не может претендовать на победу. На Terminal-Bench-Science (агентные научные исследования) Astra берет 64.6% против 58.7% у нового Клода. Это честная таблица - Anthropic не стала прятать неудобные результаты, и это само по себе уже говорит об уверенности компании в общей картине.

Ценовой аргумент при этом убедителен: на FrontierCode Opus 5.5 обходит GPT-6 Astra примерно при 20% стоимости за задачу. На Terminal-Bench ту же производительность можно купить за 40% цены Astra. Для бизнеса это не маркетинг, а реальный ROI.

Конец эпохи "клодовщины"

Отдельная история - обещание починить то, что в сообществе давно прозвали "Claudish". Модели Claude исторически писали тяжело: длинные вводные конструкции, избыточные оговорки, склонность к формульным ответам, которые выглядят умными, но читаются как бюрократический отчет. Кто работал с Claude на длинных сессиях - знает это ощущение, когда модель как будто уклоняется от прямого ответа.

Anthropic говорит, что Opus 5.5 ставит главное вперед, режет жаргон и точнее следует инструкциям по стилю. Ранние тестеры описывают текст как более чистый и понятный. Верить маркетинговым описаниям - дело неблагодарное, но проблема "клодовщины" была достаточно системной, чтобы Anthropic в принципе решила упомянуть ее в официальном анонсе. Это признание, что проблема существовала.

Для тех, кто использует Claude в контент-конвейерах или для генерации деловых текстов, это может оказаться важнее любых бенчмарков по кодингу.

Безопасность и маршрутизация запросов

Opus 5.5 - первая модель серии Opus с защитными механизмами уровня Fable 5.1 в областях кибербезопасности, биологии и разработки фронтирных языковых моделей. Когда эти фильтры срабатывают, запрос перенаправляется на другую модель: чувствительные запросы по кибербезопасности уходят на Opus 4.8, а запросы по биологии и разработке фронтирных LLM - на Opus 5. Anthropic называет такую схему прозрачной маршрутизацией.

При этом работа с кодом не ломается: находить и чинить баги по-прежнему можно, даже если запрос касается уязвимостей.

Что будет дальше

Sonnet 5.5 и Haiku 5.5 выйдут в ближайшие недели с аналогичными улучшениями по производительности, скорости и безопасности. Подписчикам Claude Pro лимиты на пятичасовые сессии вырастут на 20%, а с учетом экономии токенов общий объем работы в рамках лимита увеличится примерно на 25%. Также появится возможность сохранить сброс лимита на нужный момент - мелочь, но удобная.

Для российских пользователей

Доступ к API Claude через anthropic.com из России требует VPN - это не изменилось. Оплата российскими картами напрямую не работает; стандартный путь - зарубежная карта или платежные агрегаторы. Claude.ai как потребительский продукт также недоступен без VPN. Бизнесам, работающим через API, проще всего идти через облачных провайдеров - AWS Bedrock и Google Cloud Vertex AI оба поддерживают модели Anthropic и имеют собственные механизмы оплаты.

Anthropic явно реагирует на давление с двух сторон: OpenAI с GPT-6 Astra наверху и китайские модели снизу, которые предлагают приемлемое качество за копейки. Opus 5.5 - ответ, который не жертвует качеством ради цены, а пытается переписать само уравнение соотношения этих двух величин.

Источники

Все эти инструменты - уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно

Похожие новости