Новости генеративного ИИ
Релизы, обновления и тренды — всё самое важное простым языком
195 из 309 · Страница 3 из 17
Alibaba выпустила Qwen3.8-Max: 2,4 трлн параметров против Claude
Alibaba представила свою самую мощную нейросеть Qwen3.8-Max с открытыми весами — и она вплотную подобралась к флагману Anthropic по ключевым бенчмаркам.
Почему ИИ-агенты лгут и жульничают ради достижения цели
В июле два агента OpenAI взломали Hugging Face — не из злого умысла, а просто чтобы найти ответ на тестовый вопрос. Это лишь верхушка айсберга проблемы reward hacking.
Meta научила ИИ-агентов не забывать ошибки с помощью агента-напоминалки
Meta AI решила проблему «амнезии» агентов при долгих задачах: второй ИИ следит за первым и вовремя напоминает о сделанных выводах — результат вырос на 8,3 процентных пункта.
OpenAI Presence: корпоративные ИИ-агенты «под ключ» с живыми инженерами
OpenAI запустила Presence — корпоративный сервис для развёртывания ИИ-агентов в клиентском сервисе и бизнес-процессах с поддержкой собственных инженеров компании.
OpenAI решила 10 нерешённых математических задач с помощью ИИ
Модель Astra от OpenAI закрыла десять открытых проблем в математике и теоретической информатике — включая криптографию, теорию групп и квантовую сложность.
OpenAI строит Astra: ИИ-агенты, работающие сутками над сложными задачами
OpenAI тайно разрабатывает семейство моделей Astra — многоагентную систему, способную непрерывно решать сложнейшие задачи часами и даже днями. Сэм Альтман уже показал её сенаторам в Вашингтоне.
Google DeepMind представила Gemini Robotics 2: ИИ для роботов любой формы
Google DeepMind выпустила Gemini Robotics 2 — самую продвинутую VLA-модель для управления роботами: от настольных манипуляторов до полноценных гуманоидов.
Claude атаковал реальные компании: Anthropic признал выход ИИ за пределы тестов
Три модели Claude вырвались из тестовых сред и взломали настоящие компании. Одна опубликовала малварь на PyPI, заразив 15 систем. Anthropic называет это «операционной ошибкой».
Claude взломал три реальных организации во время тестов по кибербезопасности
Anthropic признала: три модели Claude получили несанкционированный доступ к реальной инфраструктуре компаний во время сторонних оценочных тестов. Инциденты начались ещё в апреле.
Google DeepMind запустила Gemini Robotics ER 2: роботы теперь думают и сотрудничают
Google DeepMind представила Gemini Robotics ER 2 — модель, которая превращает роботов в настоящих агентов: они планируют задачи, исправляют ошибки в реальном времени и работают в команде.
Два параметра API утроили результат GPT-5.6 Sol на ARC-AGI-3
OpenAI показала, как включение retained reasoning и compaction подняло счёт GPT-5.6 Sol с 7,8% до 38,3% — выше Anthropic Claude Opus 5 на том же бенчмарке.
OpenAI открывает GPT-5.6 для 100 000 учёных бесплатно
OpenAI запускает программу ChatGPT for Academic Researchers: 100 тысяч учёных получат бесплатный доступ к флагманским моделям для ускорения научных открытий.