Новости генеративного ИИ

Релизы, обновления и тренды - все самое важное простым языком

21 из 437

Microsoft
Голос

Microsoft выпустила голосовые модели: транскрипция за 100 мс и клонирование голоса

Microsoft AI представила MAI-Transcribe-2-Streaming и две TTS-модели серии MAI-Voice-2.1 в режиме public preview. Первые результаты транскрипции - уже через 100 миллисекунд, поддержка 60 языков.

2 октября3 мин чтения
Nvidia
Голос

Nvidia выпустила бесплатную модель: восемь голосов в реальном времени

Nvidia открыла веса Nemotron 3 Diarization - 100-миллионная модель различает до восьми говорящих в прямом эфире с рекордно низкой ошибкой 14,7%.

27 сентября4 мин чтения
Google
Голос

Gemini сам позвонит в ресторан вместо вас: новая функция Pixel 11

Google запустила "Call for Me" для Pixel 11 - Gemini теперь звонит в компании сам, ждет на удержании и ведет разговор, пока вы наблюдаете за транскриптом.

24 сентября4 мин чтения
T
Голос

Tencent Gander: ИИ-ассистент, который работает и болтает одновременно

Tencent представила Gander - голосового агента с раздельной архитектурой "мозжечок/мозг", который ведет диалог в реальном времени, пока фоновый агент пишет код или ищет файлы.

21 сентября4 мин чтения
Apple
Голос

Apple переписала Siri на базе Gemini - но не для iPhone и iPad в Европе

После многолетних задержек Apple выпустила полностью переработанного Siri на движке Google Gemini. Европейские пользователи iPhone и iPad не получат его при выходе iOS 27 и iPadOS 27 из-за разногласий с регуляторами ЕС - хотя на macOS 27 и visionOS 27 доступ будет.

15 сентября5 мин чтения
Apple
Голос

iOS 27 вернул мне Siri: как Apple наконец сдержала обещание

Два года задержек, новый движок и полный переход в отдельное приложение - Siri в iOS 27 стал тем, чем должен был быть еще в 2024-м.

14 сентября5 мин чтения
OpenAI
Голос

OpenAI открыла GPT-Live-1: голосовой API, который слушает и говорит одновременно

OpenAI выпустила GPT-Live-1 для разработчиков: полный дуплекс, задержка перехода хода разговора 0.8 секунды и цена $0.05 в минуту за голосовой слой. Модель уже работает в Yelp.

10 сентября4 мин чтения
Google
Голос

Google Assistant умрет 4 сентября: Gemini или ничего

Google официально объявила дату смерти Assistant на Android - 4 сентября 2026 года. Миллионы пользователей переведут на Gemini принудительно, без права вернуться назад.

5 августа4 мин чтения
Anthropic
Голос

Голос Claude стал умнее: Opus и Sonnet теперь говорят вместо Haiku

Anthropic переводит голосовой режим Claude на топовые модели и добавляет интеграцию с Gmail, Slack и Calendar - первый голосовой ИИ, реально отправляющий письма.

24 июля4 мин чтения
Anthropic
Голос

Голосовой режим Claude теперь работает с Opus и Sonnet

Anthropic открыла голосовой режим для своих мощных моделей Opus и Sonnet - теперь голосом можно решать реальные бизнес-задачи, а не только спрашивать погоду.

23 июля4 мин чтения
A
Голос

Qwen Audio 3.0 TTS Plus от Alibaba возглавил мировой рейтинг голосовых ИИ

Модель Alibaba обошла всех конкурентов в независимом рейтинге Speech Arena, поддерживает 16 языков и управляется эмоциональными тегами - но в скорости безнадежно отстает.

21 июля4 мин чтения
OpenAI
Голос

OpenAI делает "живую" колонку без экрана: ИИ-компаньон для дома

OpenAI выходит на рынок железа с портативной умной колонкой без экрана - она двигается, учится и чувствует себя живой. Но судебный иск Apple может все сломать.

15 июля5 мин чтения

🔥 Популярные теги

🚀 Genova-ai

Все ИИ-инструменты без VPN и зарубежных карт

Попробовать бесплатно →