Новости генеративного ИИ

Релизы, обновления и тренды — всё самое важное простым языком

13 из 309 · Страница 1 из 2

M
Видео

MiniMax H3: первая открытая модель на вершине видеорейтинга

Китайская MiniMax выложила веса модели H3 в открытый доступ — и та сразу возглавила мировой рейтинг по видеоредактированию, обогнав всех закрытых конкурентов.

3 августа4 мин чтения
B
Видео

ByteDance Seedance 2.5: 30 секунд видео с аудио за один проход

ByteDance выпустила Seedance 2.5 — ИИ-модель, которая генерирует 30-секундное видео вместе со звуком за один проход, втрое превышая возможности Google Gemini.

1 августа4 мин чтения
B
Видео

FLUX 3 от Black Forest Labs: один мультимодальный монстр для всего

Black Forest Labs выпустила FLUX 3 — единую мультимодальную модель для изображений, видео, аудио и управления роботами, которая уже обходит Seedance 2.0 и Grok Imagine.

24 июля4 мин чтения
G
Видео

Google DeepMind: видеогенераторы уже содержат модели мира для компьютерного зрения

GenCeption от DeepMind превращает видеогенератор в универсальную систему компьютерного зрения — и обходит специализированных конкурентов, обучившись на в 500 раз меньшем объёме данных.

19 июля5 мин чтения
Hugging Face
Видео

NVIDIA NeMo + Hugging Face Diffusers: дообучение видео и изображений на промышленных масштабах

NVIDIA и Hugging Face объединили NeMo Automodel с библиотекой Diffusers — теперь файн-тюнинг диффузионных моделей видео и изображений стал доступен на кластерах GPU промышленного масштаба.

18 июля4 мин чтения
A
Видео

Adobe поглощает Topaz Labs: ИИ-апскейлинг войдёт в Creative Cloud

Adobe объявила о покупке Topaz Labs — создателей ИИ-моделей для улучшения видео и фото. Инструменты интегрируют в Firefly и всю экосистему Creative Cloud.

25 июня4 мин чтения
xAI
Видео

xAI запускает Grok Imagine Video 1.5: фото оживают со звуком в 720p

Компания Илона Маска выпустила превью-версию Grok Imagine Video 1.5 — модель превращает статичные изображения в видео до 720p с нативным синхронизированным звуком.

4 июня4 мин чтения
M
Видео

Meituan открыла фреймворк для создания цифровых людей

Китайский технологический гигант Meituan выложил в открытый доступ инструментарий для разработки виртуальных персонажей. Разбираемся, зачем это нужно и что получит рынок.

28 мая5 мин чтения
Google
Видео

Google Omni: ИИ превращает любой контент в видео — тест на плюшевом олене

Google запустила Omni Flash — мультимодальную модель, которая делает видео из чего угодно. Мы проверили, насколько это реально работает.

23 мая4 мин чтения
NVIDIA
Видео

NVIDIA SANA-WM: минутное 720p видео с одной видеокарты

NVIDIA выпустила открытую модель SANA-WM на 2,6 млрд параметров — она генерирует 60-секундное видео в 720p с точным управлением камерой и работает на одном RTX 5090.

16 мая4 мин чтения
Google
Видео

Google Gemini Omni: видеомодель, которая видит и понимает в реальном времени

Google представил Gemini Omni — мультимодальную модель с нативной поддержкой видео. Теперь ИИ анализирует видеопоток в реальном времени, а не кадр за кадром.

11 мая5 мин чтения
OpenAI
Видео

OpenAI хоронит Sora: уходит создатель и топ-менеджеры

Билл Пиблс, руководивший командой Sora, покидает OpenAI вслед за закрытием проекта. Компания режет «побочные квесты» и делает ставку на код и корпоративных клиентов.

19 апреля4 мин чтения

🔥 Популярные теги

🚀 Genova-ai

Все ИИ-инструменты без VPN и зарубежных карт

Попробовать бесплатно →