Google DeepMind
Google DeepMind — британско-американская лаборатория искусственного интеллекта, дочерняя компания Alphabet Inc., занимающаяся фундаментальными исследованиями и разработкой безопасных AI-систем.
О компании
Google DeepMind была основана в ноябре 2010 года Демисом Хасабисом, Шейном Леггом и Мустафой Сулейманом в Лондоне, с междисциплинарным подходом к созданию универсальных AI-систем, объединяющим машинное обучение, нейронауки, математику и инженерию. В 2014 году компания была приобретена Google, а в апреле 2023 года слилась с подразделением Google Brain, образовав единую организацию Google DeepMind под руководством CEO Демиса Хасабиса.
Компания стала автором ряда ключевых прорывов в области AI: AlphaGo победила профессионального игрока в го, AlphaFold произвела революцию в предсказании структур белков, AlphaStar стала первой AI-системой, победившей профессионала в StarCraft II. Также были разработаны AlphaCode (генерация кода), WaveNet (синтез речи), а также генеративные модели Gemini, Imagen (изображения), Veo (видео) и Lyria (музыка).
Миссия Google DeepMind — «решить проблему интеллекта и использовать это для решения всего остального». Компания делает акцент на ответственном и безопасном развитии AI, публикует исследования в ведущих научных журналах (Nature, Science) и стремится к тому, чтобы технологии приносили пользу всему человечеству.
Все модели Google DeepMind (38)
💬ИИ-чат (20)
Лидер бенчмарков 2026 года: 77.1% ARC-AGI-2 и 94.3% GPQA Diamond с контекстом 1 млн.
Флагман Google поколения Gemini 3 (ноябрь 2025): нативно мультимодальная модель (текст, изображение, видео, аудио, код) с контекстом 1M токенов и встроенным рассуждением. Преемник — Gemini 3.1 Pro (февраль 2026) по той же цене. В России без VPN не работает.
Новая рабочая лошадка Google (21 июля 2026) — модель, которую компания выпустила вместо задержавшейся Gemini 3.5 Pro. Сильнее предшественницы в коде, экспертной работе и мультимодальности, при этом расходует на 17% меньше токенов и стоит дешевле: $1.50/$7.50 за 1M. Контекст 1M, вход — текст, изображения, видео, аудио и PDF.
Быстрая фронтир-модель Google (релиз 19 мая 2026 на I/O) — Flash, который обошёл прошлогодний Gemini 3.1 Pro в коде и агентных задачах. В 4× быстрее других фронтир-моделей, контекст 1M, dynamic thinking по умолчанию. Цена выросла втрое к Gemini 3 Flash, но всё ещё дешевле Pro. В России без VPN не работает.
Открытое семейство моделей Google (2 апреля 2026, Apache 2.0): от Effective 2B/4B для телефонов до 26B MoE и 31B Dense, плюс мультимодальная 12B без энкодеров (3 июня). Контекст до 256K, 140+ языков, мультимодальный вход. Флагман 31B входит в топ-3 Arena среди текстовых моделей, обходя кратно более крупных конкурентов.
Быстрая и дешёвая мультимодальная модель Google (релиз 17 июня 2025) — первая Flash с режимом рассуждений (thinking). Контекст 1M токенов, ввод текста, изображений, аудио и видео. Лучший баланс цена/качество в линейке Gemini для массовых задач. В России без VPN не работает.
Самая быстрая и дешёвая модель в линейке Gemini 3 от Google (превью — 3 марта 2026, GA — 7 мая): около 380 токенов/сек, контекст 1M, мультимодальный вход (текст, изображения, аудио, видео). Цена $0.25/$1.50 за 1M токенов — под высоконагруженные и латентно-чувствительные задачи. Сильна в мультимодальности для своего класса.
Флагманская мультимодальная модель Google с рассуждениями и контекстом 1 млн токенов.
Самая быстрая и дешёвая модель линейки Gemini 3.5 (21 июля 2026): $0.30/$2.50 за 1M токенов — впятеро дешевле по входу, чем Gemini 3.6 Flash. Выдаёт около 460 токенов в секунду, контекст 1M, вход текст/изображения/речь/видео. Создана под массовые задачи: поиск, обработку документов и перевод.
Быстрая мультимодальная модель с живым режимом речи и видео.
Мультимодальная модель с контекстным окном до 1 миллиона токенов.
Открытая мультимодальная модель с контекстом 128K и пониманием изображений/видео.
Модель для предсказания 3D-структуры белков и молекулярных взаимодействий.
Открытая модель Google для использования непосредственно на устройствах.
Самая лёгкая и быстрая модель семейства Gemini.
Автономный агент Google для многоступенчатого синтеза информации.
Экспериментальная модель генерации текста через диффузию с высокой скоростью.
Открытая языковая модель Google с оптимальным соотношением качества и размера.
Самая мощная модель в семействе Gemini для наиболее сложных задач.
Компактная модель Gemini для работы на мобильных устройствах.
🎨Картинки (6)
Флагманский генератор изображений Google на базе Gemini 3 Pro (официально — Gemini 3 Pro Image). Лучший на рынке рендер текста прямо на картинке, включая длинные абзацы и мультиязычную вёрстку, разрешение до 4K, точечное редактирование и сохранение внешности до 5 персонажей. В API — от $0.134 за изображение.
Семейство генераторов изображений Google (общая доступность — февраль 2026) из трёх версий под разные задачи: Fast за $0.02, обычная за $0.04 и Ultra за $0.06 за картинку. Разрешение до 2K, заметно улучшенный рендер текста. Все изображения помечаются невидимым водяным знаком SynthID.
Модель генерации фотореалистичных изображений от Google.
Модель Google (Gemini 3.1 Flash Image) — баланс скорости и качества с улучшенным рендерингом текста.
Модель генерации изображений Google (Gemini 2.5 Flash Image) с быстрой генерацией и логическим пониманием промптов.
Вторая версия Google Imagen с улучшенным фотореализмом и рендерингом текста.
🎬Видео (5)
Улучшенная версия с референс-изображениями, расширением сцен и контролем первого/последнего кадра.
Видеогенератор Google DeepMind с нативным синхронным звуком в одном проходе — диалоги с лип-синком, звуковые эффекты и эмбиент. Клипы по 8 секунд в 720p/1080p/4K, поддержка image-to-video.
ИИ-инструмент Google для кинематографического производства с поддержкой Nano Banana Pro.
Модель генерации видео до 4K и 2 минут длительности.
Первая модель видеогенерации Google DeepMind, представленная на I/O 2024.
🎵Музыка (2)
Музыкальная модель Google DeepMind (29 июля 2026) в сервисе Flow Music: генерирует треки от 30 секунд до 3 минут с вокалом и текстом, выход 48 кГц 16-бит стерео. Главная новинка — Selective Section Painting: можно переделать отдельный фрагмент трека, не пересоздавая песню заново, и развернуть короткую мелодию в полноценный трек.
Экспериментальная модель генерации музыки из текстовых описаний.
💻Генерация кода (4)
Специализированная модель Google для кибербезопасности (21 июля 2026): дообучена на поиск и устранение уязвимостей в коде. Публично НЕдоступна — выдаётся только правительствам и доверенным партнёрам в рамках ограниченной пилотной программы. Ещё один пример того, как киберспособные модели уходят под контролируемый доступ.
Асинхронный автономный кодинг-агент Google (GA с августа 2025): ставите задачу — он работает в изолированной облачной виртуалке с копией вашего репозитория и присылает готовый pull request. Не чат, а «отдал задачу и ушёл». Работает на Gemini (Pro для планирования, Flash для лёгкого), сейчас на уровне Gemini 3.1 Pro.
Эволюционный кодинг-агент Google DeepMind (май 2025) для поиска и улучшения алгоритмов. Связывает Gemini (Flash для широты идей, Pro для глубины) с автоматическими проверщиками в эволюционном цикле. Нашёл способ умножать матрицы 4×4 за 48 умножений — первое улучшение за 56 лет. Не потребительский продукт, а исследовательская система.
Открытая лёгкая модель Google для кода (февраль 2024) на базе Gemma: варианты 2B (быстрое автодополнение) и 7B (генерация + чат по коду). Запускается локально, заточена под дополнение и infill. Сегодня — добротная «классика» начального уровня; новое поколение открытых моделей Google — Gemma 4.
Последние новости Google DeepMind
Google DeepMind переделала готовую Gemma 4 в диффузионную модель, потратив менее 10% исходного бюджета обучения. Результат — 1500 токенов в секунду и принципиально новый подход к генерации текста.
Google DeepMind выпустил WeatherNext Cyclones — ИИ-модель для прогнозирования тропических циклонов, которая опережает лучшие оперативные системы примерно на сутки и открыта для всего мира.
Демис Хасабис покидает пост CEO DeepMind ради роли главного учёного Alphabet, а Джефф Дин после 27 лет в Google запускает стартап по автоматизации науки.
Google DeepMind выпустила Gemini Robotics 2 — самую продвинутую VLA-модель для управления роботами: от настольных манипуляторов до полноценных гуманоидов.
Google DeepMind представила Gemini Robotics ER 2 — модель, которая превращает роботов в настоящих агентов: они планируют задачи, исправляют ошибки в реальном времени и работают в команде.