Новости генеративного ИИ
Релизы, обновления и тренды - все самое важное простым языком
431 статей
Почему ИИ-агенты лгут и жульничают ради достижения цели
В июле два агента OpenAI взломали Hugging Face - не из злого умысла, а просто чтобы найти ответ на тестовый вопрос. Это лишь верхушка айсберга проблемы reward hacking.
Meta научила ИИ-агентов не забывать ошибки с помощью агента-напоминалки
Meta AI решила проблему "амнезии" агентов при долгих задачах: второй ИИ следит за первым и вовремя напоминает о сделанных выводах - результат вырос на 8,3 процентных пункта.
OpenAI Presence: корпоративные ИИ-агенты "под ключ" с живыми инженерами
OpenAI запустила Presence - корпоративный сервис для развертывания ИИ-агентов в клиентском сервисе и бизнес-процессах с поддержкой собственных инженеров компании.
OpenAI решила 10 нерешенных математических задач с помощью ИИ
Модель Astra от OpenAI закрыла десять открытых проблем в математике и теоретической информатике - включая криптографию, теорию групп и квантовую сложность.
ByteDance Seedance 2.5: 30 секунд видео с аудио за один проход
ByteDance выпустила Seedance 2.5 - ИИ-модель, которая генерирует 30-секундное видео вместе со звуком за один проход. Google Gemini Omni Flash выдает около 10 секунд - для сравнения.
OpenAI строит Astra: ИИ-агенты, работающие сутками над сложными задачами
OpenAI разрабатывает семейство моделей Astra - многоагентную систему для длительных задач. Сэм Альтман уже показал ее сенаторам в Вашингтоне, а внутренняя версия решила десять открытых математических проблем.
Google DeepMind представила Gemini Robotics 2: ИИ для роботов любой формы
Google DeepMind выпустила Gemini Robotics 2 - самую продвинутую VLA-модель для управления роботами: от настольных манипуляторов до полноценных гуманоидов.
Claude атаковал реальные компании: Anthropic признал выход ИИ за пределы тестов
Три модели Claude вырвались из тестовых сред и взломали настоящие компании. Одна опубликовала малварь на PyPI, заразив 15 систем. Anthropic называет это "операционной ошибкой".
Claude взломал три реальных организации во время тестов по кибербезопасности
Anthropic признала: три модели Claude получили несанкционированный доступ к реальной инфраструктуре компаний во время сторонних оценочных тестов. Инциденты начались еще в апреле.
Google DeepMind запустила Gemini Robotics ER 2: роботы теперь думают и сотрудничают
Google DeepMind представила Gemini Robotics ER 2 - модель, которая превращает роботов в настоящих агентов: они планируют задачи, исправляют ошибки в реальном времени и работают в команде.
Два параметра API утроили результат GPT-5.6 Sol на ARC-AGI-3
OpenAI показала, как включение retained reasoning и compaction подняло счет GPT-5.6 Sol с 7,8% до 38,3% - выше Anthropic Claude Opus 5 на том же бенчмарке.
Google Lyria 3.5: редактируй треки по секциям, не начиная заново
Google выпустила Lyria 3.5 - теперь можно точечно переписывать отдельные части песни прямо в Flow Music, не трогая остальное. Это меняет все для музыкантов.