Новости генеративного ИИ
Релизы, обновления и тренды - все самое важное простым языком
22 из 431
YouTube добавил в Creator Studio ИИ-инструменты: анализ черновиков, умные превью, Gemini в Shorts
На ежегодном Made on YouTube платформа представила волну ИИ-инструментов для авторов: от анализа черновиков до живого перевода стримов с английского на испанский.
ByteDance запустил Dramagic: ИИ-конвейер от сценария до видео
ByteDance выпустил платформу Dramagic, которая закрывает весь цикл производства короткого видео. В Китае за первый квартал 2026 года вышло 128 000 мини-сериалов, 95% из них сгенерированы ИИ.
Runway исследует генерацию видео в реальном времени - потоком, кадр за кадром
Runway поделилась материалами о своих исследованиях в области мгновенной генерации видео: вместо ожидания готового клипа - потоковая трансляция кадр за кадром прямо во время ввода промпта.
Gemini научился смотреть видео по-умному: до минус 88% токенов
Google запустила агентный анализ видео для Gemini Flash - модель сама решает, какие фрагменты смотреть, и экономит до 88% токенов при росте точности.
Runway Solaris: ИИ генерирует интерфейсы прямо в реальном времени
Runway представила Solaris - систему, которая рисует интерфейс приложения кадр за кадром без единой строки кода. Конец эпохи фиксированных приложений?
Fal H3 Max Live: видео генерируется быстрее, чем вы его смотрите
Fal разогнал модель Minimax H3 в 35 раз и сломал главный барьер видеогенерации - теперь ИИ создает кадры быстрее реального времени. Что это меняет?
LAION открыл крупнейший видеодатасет: 80 млн видео и 10 млн часов
Некоммерческая организация LAION выпустила Big Video Dataset - один из крупнейших открытых наборов данных для обучения видеомоделей, побивший предыдущий эталон InternVid.
Gemini Omni 1.1 Flash: Google дает разработчикам больше контроля над ИИ-видео
Google DeepMind выпустила Gemini Omni 1.1 Flash - обновление для разработчиков с расширением сцен, 4K-апскейлингом и точным контролем ключевых кадров. Модель доступна через Google AI Studio и Gemini Enterprise Agent Platform в режиме Preview.
Alibaba Wan3.0: видео до 30 секунд из PDF и PowerPoint за $6
Новая модель Alibaba превращает документы, презентации и веб-страницы в видеоролики HD-качества. Тридцать секунд в 1080p - всего шесть долларов.
MiniMax H3: первая открытая модель на вершине видеорейтинга
Китайская MiniMax выложила веса модели H3 в открытый доступ - и та сразу возглавила мировой рейтинг по видеоредактированию, обогнав всех закрытых конкурентов.
ByteDance Seedance 2.5: 30 секунд видео с аудио за один проход
ByteDance выпустила Seedance 2.5 - ИИ-модель, которая генерирует 30-секундное видео вместе со звуком за один проход. Google Gemini Omni Flash выдает около 10 секунд - для сравнения.
FLUX 3 от Black Forest Labs: мультимодальная модель для изображений, видео и аудио
Black Forest Labs выпустила FLUX 3 - единую мультимодальную модель для изображений, видео и аудио, которая в пользовательских сравнениях обошла Seedance 2.0, Gemini Omni и Grok Imagine. Отдельная производная модель FLUX-mimic уже работает на роботах у партнеров.