Новости генеративного ИИ
Релизы, обновления и тренды - все самое важное простым языком
264 из 426
Hugging Face показывает результаты всех бенчмарков прямо на страницах моделей
Hugging Face запускает инициативу Every Eval Ever: теперь все результаты оценки моделей собраны в одном месте, а вычисления на оценку стали дороже обучения.
DSpark от DeepSeek: ИИ быстрее на 85% без топовых чипов
DeepSeek выпустил DSpark - фреймворк спекулятивного декодирования, ускоряющий ответы ИИ на 60-85%. Это прямой удар по санкционной логике США.
Coinbase режет расходы на ИИ вдвое, переходя на китайские модели
Глава Coinbase Брайан Армстронг перевел компанию на GLM 5.2 и Kimi 2.7, срезав ИИ-бюджет наполовину при рекордном росте потребления токенов.
CEO-Bench: только 3 ИИ-модели не обанкротились за 500 дней
Принстонские исследователи создали симулятор стартапа - и большинство ИИ-агентов разорились. Простая эвристика без ИИ обошла почти всех.
VibeThinker-3B: крошечная модель бьет гигантов в математике
Трехмиллиардная модель от Sina Weibo сравнялась с DeepSeek V3.2 и Kimi K2.5 на олимпийских задачах - при том что те в 333 раза больше. Секрет - не размер, а умная пост-тренировка.
iLLaDA от ByteDance: диффузионная LLM, которая не хуже Qwen2.5
ByteDance и Университет Жэньминь выпустили iLLaDA - 8B модель, генерирующую текст не токен за токеном, а сразу целыми последовательностями. На базовых бенчмарках она обходит Qwen2.5 7B.
Белый дом тормозит GPT-5.6: почему вы не можете его попробовать
OpenAI задержала релиз GPT-5.6 по требованию администрации Трампа - через две недели после того, как Anthropic был вынужден отключить свои топовые модели.
GPT-5.6 под контролем Вашингтона: доступ только с одобрения правительства США
OpenAI вынуждена выдавать доступ к GPT-5.6 поштучно - каждого клиента должно одобрить американское правительство. Сэм Альтман назвал это "не предпочтительной долгосрочной моделью".
NVIDIA Blackwell сметает все: абсолютная победа в MLPerf Training 6.0
NVIDIA взяла все до единого бенчмарка в MLPerf Training v6.0, включая новые тесты на DeepSeek-V3 и GPT-OSS-20B - и сделала это единственная среди участников.
OpenAI и Broadcom представили собственный чип Jalapeño для ИИ-инференса
OpenAI впервые создала собственный чип - ASIC под названием Jalapeño, разработанный с нуля специально для инференса больших языковых моделей. Развертывание в дата-центрах запланировано уже на конец 2026 года.
OpenAI показала первый собственный чип: знакомьтесь, Jalapeño
OpenAI и Broadcom представили чип Jalapeño - специализированный процессор для инференса ИИ-моделей, разработанный за 9 месяцев с помощью самих ИИ-систем компании.
Claude Tag в Slack: ИИ-коллега, который помнит все за вас
Anthropic запустила Claude Tag - постоянно активного ИИ-агента прямо в Slack. Он читает переписку, берет задачи и накапливает корпоративную память.