Новости генеративного ИИ
Релизы, обновления и тренды - все самое важное простым языком
21 из 437
Microsoft выпустила голосовые модели: транскрипция за 100 мс и клонирование голоса
Microsoft AI представила MAI-Transcribe-2-Streaming и две TTS-модели серии MAI-Voice-2.1 в режиме public preview. Первые результаты транскрипции - уже через 100 миллисекунд, поддержка 60 языков.
Nvidia выпустила бесплатную модель: восемь голосов в реальном времени
Nvidia открыла веса Nemotron 3 Diarization - 100-миллионная модель различает до восьми говорящих в прямом эфире с рекордно низкой ошибкой 14,7%.
Gemini сам позвонит в ресторан вместо вас: новая функция Pixel 11
Google запустила "Call for Me" для Pixel 11 - Gemini теперь звонит в компании сам, ждет на удержании и ведет разговор, пока вы наблюдаете за транскриптом.
Tencent Gander: ИИ-ассистент, который работает и болтает одновременно
Tencent представила Gander - голосового агента с раздельной архитектурой "мозжечок/мозг", который ведет диалог в реальном времени, пока фоновый агент пишет код или ищет файлы.
Apple переписала Siri на базе Gemini - но не для iPhone и iPad в Европе
После многолетних задержек Apple выпустила полностью переработанного Siri на движке Google Gemini. Европейские пользователи iPhone и iPad не получат его при выходе iOS 27 и iPadOS 27 из-за разногласий с регуляторами ЕС - хотя на macOS 27 и visionOS 27 доступ будет.
iOS 27 вернул мне Siri: как Apple наконец сдержала обещание
Два года задержек, новый движок и полный переход в отдельное приложение - Siri в iOS 27 стал тем, чем должен был быть еще в 2024-м.
OpenAI открыла GPT-Live-1: голосовой API, который слушает и говорит одновременно
OpenAI выпустила GPT-Live-1 для разработчиков: полный дуплекс, задержка перехода хода разговора 0.8 секунды и цена $0.05 в минуту за голосовой слой. Модель уже работает в Yelp.
Google Assistant умрет 4 сентября: Gemini или ничего
Google официально объявила дату смерти Assistant на Android - 4 сентября 2026 года. Миллионы пользователей переведут на Gemini принудительно, без права вернуться назад.
Голос Claude стал умнее: Opus и Sonnet теперь говорят вместо Haiku
Anthropic переводит голосовой режим Claude на топовые модели и добавляет интеграцию с Gmail, Slack и Calendar - первый голосовой ИИ, реально отправляющий письма.
Голосовой режим Claude теперь работает с Opus и Sonnet
Anthropic открыла голосовой режим для своих мощных моделей Opus и Sonnet - теперь голосом можно решать реальные бизнес-задачи, а не только спрашивать погоду.
Qwen Audio 3.0 TTS Plus от Alibaba возглавил мировой рейтинг голосовых ИИ
Модель Alibaba обошла всех конкурентов в независимом рейтинге Speech Arena, поддерживает 16 языков и управляется эмоциональными тегами - но в скорости безнадежно отстает.
OpenAI делает "живую" колонку без экрана: ИИ-компаньон для дома
OpenAI выходит на рынок железа с портативной умной колонкой без экрана - она двигается, учится и чувствует себя живой. Но судебный иск Apple может все сломать.