Голосовой режим Claude теперь работает с Opus и Sonnet

Haiku был репетицией, Opus и Sonnet - это уже серьезно
Когда Anthropic год назад запустила голосовой режим для Claude, многие восприняли это как ответный выпад против ChatGPT Voice. Но была одна загвоздка: голос работал только с Haiku - быстрой, легкой, но откровенно "поверхностной" моделью. Попробуй обсудить с ней стратегию масштабирования стартапа или разобрать сложный юридический документ - и ты очень быстро упрешься в потолок. Anthropic это прекрасно понимала, и теперь сделала то, чего многие ждали: открыла голосовой режим для Sonnet и Opus.
Это не косметическое обновление. Это принципиальная смена позиционирования всего продукта.
Что реально изменилось
По данным самой Anthropic, пользователи с первых дней начали использовать голосовой режим совсем не так, как планировалось. Вместо быстрых вопросов типа "какая погода" или "переведи слово" - люди пытались обсуждать бизнес-проблемы, брейнштормить, анализировать ситуации. Haiku с этим справлялась плохо: ответы были быстрые, но неглубокие. Теперь Sonnet и Opus закрывают этот пробел.
Оба этих варианта позиционируются Anthropic как модели для "сложного решения проблем" - и это действительно так. Sonnet - оптимальный баланс между скоростью и качеством, Opus - флагман, способный на по-настоящему многоуровневый анализ. Использовать Opus голосом для разработки питча или реструктуризации расписания - это уже не игрушка, это рабочий инструмент.
Отдельно понравилась фича переключения между моделями прямо в разговоре. Начал с Haiku - получил быстрый ответ, зацепила идея - переключился на Opus и копнул глубже. Без перезапуска, без потери контекста. Это грамотно.
Интеграции: Gmail, Slack, Canva
Anthropic также расширяет голосовой доступ к сторонним приложениям. Gmail, Slack и Canva - три совершенно разных контекста, и это не случайный выбор. Gmail - это коммуникация и управление почтой голосом. Slack - корпоративные чаты и задачи. Canva - креативная работа. Вместе они покрывают огромный пласт ежедневной офисной рутины.
Представьте: вы едете в метро, опаздываете на встречу, говорите Claude голосом - и он сам перекраивает ваш календарь и отправляет уведомления в Slack коллегам. Это не фантастика, это буквально то, что описывает Anthropic как сценарий использования прямо сейчас.
Для сравнения: у OpenAI голосовой режим GPT-4o тоже умеет работать с инструментами, но интеграции с конкретными приложениями через голос пока ощущаются менее органично. Google с Gemini Live делает похожие шаги, но фокус там пока на Android-экосистеме. Anthropic же целится в профессиональный контекст - и это стратегически умно.
Языки: русский пока не в списке
Тут есть и хорошие, и не очень хорошие новости для нашей аудитории. Anthropic вывела из бета-статуса голосовой режим на французском, немецком, испанском, хинди, индонезийском, итальянском, японском, корейском и португальском языках. Девять языков - неплохо.
Но русского в списке нет. Это расстраивает, хотя и не удивляет - Anthropic традиционно осторожна с русскоязычным рынком, и геополитический контекст тут явно играет роль. Для российских пользователей это означает, что голосовой режим на русском по-прежнему либо недоступен, либо работает нестабильно.
Кстати, про доступность в России: Claude в целом работает через VPN, прямого доступа без него нет. Оплата российскими картами также не работает - нужны либо зарубежные карты, либо сервисы-посредники. Это не изменилось с новым обновлением.
Почему это важно прямо сейчас
Мы находимся в интересной точке развития голосовых ИИ-интерфейсов. Год назад это была "вау-фича" для демонстраций. Сегодня это начинает превращаться в реальный рабочий инструмент. И ключевое слово здесь - "начинает".
Голосовой интерфейс с мощной моделью вроде Opus меняет саму механику взаимодействия с ИИ. Текстовый промпт требует от тебя четкости и структуры - ты должен уметь формулировать запрос письменно. Голос более естественен, более итеративен: ты думаешь вслух, модель реагирует, ты уточняешь. Это ближе к тому, как люди реально думают.
Для бизнеса это открывает интересные сценарии: голосовые ассистенты для менеджеров, которые не хотят печатать; инструменты для брейнштормов в движении; автоматизация рутины через разговор. Для разработчиков - новые API-возможности для встраивания голосового Claude в собственные продукты.
Мой вывод
Anthropic делает правильные вещи в правильном порядке. Запустить голос на слабой модели, собрать данные о реальном использовании, понять что люди хотят большего - и только потом открыть мощные модели. Это не медлительность, это осознанная итерация.
Голосовой Opus - это уже не просто удобство, это потенциально новый класс ИИ-инструментов для профессионального использования. Посмотрим, как быстро OpenAI и Google ответят. Гонка голосовых интерфейсов только разгорается.
Источники
Похожие новости
Microsoft выпустила голосовые модели: транскрипция за 100 мс и клонирование голоса
Microsoft AI представила MAI-Transcribe-2-Streaming и две TTS-модели серии MAI-Voice-2.1 в режиме public preview. Первые результаты транскрипции - уже через 100 миллисекунд, поддержка 60 языков.
Nvidia выпустила бесплатную модель: восемь голосов в реальном времени
Nvidia открыла веса Nemotron 3 Diarization - 100-миллионная модель различает до восьми говорящих в прямом эфире с рекордно низкой ошибкой 14,7%.
Gemini сам позвонит в ресторан вместо вас: новая функция Pixel 11
Google запустила "Call for Me" для Pixel 11 - Gemini теперь звонит в компании сам, ждет на удержании и ведет разговор, пока вы наблюдаете за транскриптом.