Новости генеративного ИИ
Релизы, обновления и тренды - все самое важное простым языком
436 статей
Серый рынок Китая: токены Claude по цене 10% от официальной
Китайские разработчики массово обходят блокировки Anthropic через сеть API-прокси, покупая токены Claude за десятую часть официальной цены - и это лишь верхушка айсберга.
Серверы Nvidia с чипами Vera Rubin и Grace Blackwell подорожают более чем на 15%
Bloomberg сообщает, что крупнейшие клиенты Nvidia уже получили уведомления о росте цен на серверные системы - причиной называют подорожание памяти от Samsung, SK Hynix и Micron.
ИИ стал главным потребителем ИИ: агенты обогнали людей в 5 раз
С февраля 2026 года агентные системы потребляют в 5 раз больше токенов, чем люди. Рост - 14x за полгода. Эра чат-ботов заканчивается.
Netflix тестирует языковую модель как альтернативу ручной логике рекомендаций: что такое GenRec
Netflix проверил языковую модель GenRec против своего продакшн-ранжировщика рекомендаций - и в офлайн-тестах, и в A/B-эксперименте GenRec показал лучшие результаты при значительно меньшем объеме размеченных данных. История просмотров превращается в обычный текст.
Скиллы для ИИ-агентов: почему работают и где ломаются
Исследование Принстона и UC San Diego раскрыло механику навыков ИИ-агентов: они помогают не знаниями, а структурой - но при росте библиотеки точность выбора рушится с 30% до 3%.
Ollama v0.33.0-rc2: интеграция с Claude Desktop и улучшенный кэш для Apple Silicon
На GitHub появился предварительный релиз v0.33.0-rc2 с поддержкой Claude Desktop, исправлениями MLX-движка и обновленным онбордингом - локальный ИИ движется в сторону полноценной платформы.
DeepSeek дает своей Flash-модели зрение и бросает вызов Claude Opus
DeepSeek выпустил экспериментальную мультимодальную модель V4-Flash-Vision-Exp, которая видит изображения и на агентных бенчмарках вплотную подходит к Anthropic Opus 4.8 - за десятую часть его цены.
Waymo создала собственный чип для роботакси и избавилась от зависимости от Nvidia
Alphabet разработала кастомный ASIC-чип мощностью 1000+ TOPS на техпроцессе TSMC 5 нм - теперь он стоит в каждом новом роботакси Waymo вместо железа от Nvidia и AMD.
NVIDIA AVO: агентная система достигла 100% на ARC-AGI-3
NVIDIA доказала: архитектура агента важнее самой модели. Система AVO подняла Claude Opus 5 с 30% до абсолютного результата на сложнейшем бенчмарке.
Adobe Firefly стал полноценной студией: музыка, голос и звук в одном месте
Adobe вывела три ИИ-инструмента для работы со звуком в общий доступ и добавила Gemini Omni Flash - теперь Firefly закрывает весь творческий цикл без переключения между сервисами.
Liquid AI ускорила инференс в 3,2 раза без потери качества
Liquid AI выпустила DSpark - черновики для спекулятивного декодирования LFM2.5, разгоняющие генерацию до 1362 токенов/с на H100 без изменения выходных данных.
Ollama v0.32.15: кэш метаданных убирает лишние задержки
Ollama выпустила обновление v0.32.15 с кэшем метаданных моделей - теперь каждый запрос к локальному LLM обрабатывается быстрее без лишних накладных расходов.