Новости генеративного ИИ
Релизы, обновления и тренды — всё самое важное простым языком
13 из 309 · Страница 1 из 2
MiniMax H3: первая открытая модель на вершине видеорейтинга
Китайская MiniMax выложила веса модели H3 в открытый доступ — и та сразу возглавила мировой рейтинг по видеоредактированию, обогнав всех закрытых конкурентов.
ByteDance Seedance 2.5: 30 секунд видео с аудио за один проход
ByteDance выпустила Seedance 2.5 — ИИ-модель, которая генерирует 30-секундное видео вместе со звуком за один проход, втрое превышая возможности Google Gemini.
FLUX 3 от Black Forest Labs: один мультимодальный монстр для всего
Black Forest Labs выпустила FLUX 3 — единую мультимодальную модель для изображений, видео, аудио и управления роботами, которая уже обходит Seedance 2.0 и Grok Imagine.
Google DeepMind: видеогенераторы уже содержат модели мира для компьютерного зрения
GenCeption от DeepMind превращает видеогенератор в универсальную систему компьютерного зрения — и обходит специализированных конкурентов, обучившись на в 500 раз меньшем объёме данных.
NVIDIA NeMo + Hugging Face Diffusers: дообучение видео и изображений на промышленных масштабах
NVIDIA и Hugging Face объединили NeMo Automodel с библиотекой Diffusers — теперь файн-тюнинг диффузионных моделей видео и изображений стал доступен на кластерах GPU промышленного масштаба.
Adobe поглощает Topaz Labs: ИИ-апскейлинг войдёт в Creative Cloud
Adobe объявила о покупке Topaz Labs — создателей ИИ-моделей для улучшения видео и фото. Инструменты интегрируют в Firefly и всю экосистему Creative Cloud.
xAI запускает Grok Imagine Video 1.5: фото оживают со звуком в 720p
Компания Илона Маска выпустила превью-версию Grok Imagine Video 1.5 — модель превращает статичные изображения в видео до 720p с нативным синхронизированным звуком.
Meituan открыла фреймворк для создания цифровых людей
Китайский технологический гигант Meituan выложил в открытый доступ инструментарий для разработки виртуальных персонажей. Разбираемся, зачем это нужно и что получит рынок.
Google Omni: ИИ превращает любой контент в видео — тест на плюшевом олене
Google запустила Omni Flash — мультимодальную модель, которая делает видео из чего угодно. Мы проверили, насколько это реально работает.
NVIDIA SANA-WM: минутное 720p видео с одной видеокарты
NVIDIA выпустила открытую модель SANA-WM на 2,6 млрд параметров — она генерирует 60-секундное видео в 720p с точным управлением камерой и работает на одном RTX 5090.
Google Gemini Omni: видеомодель, которая видит и понимает в реальном времени
Google представил Gemini Omni — мультимодальную модель с нативной поддержкой видео. Теперь ИИ анализирует видеопоток в реальном времени, а не кадр за кадром.
OpenAI хоронит Sora: уходит создатель и топ-менеджеры
Билл Пиблс, руководивший командой Sora, покидает OpenAI вслед за закрытием проекта. Компания режет «побочные квесты» и делает ставку на код и корпоративных клиентов.