GLM-4.7

GLM-4.7

Флагманская открытая модель Zhipu AI (Z.ai), 22 декабря 2025: MoE на 355B с 32B активных, контекст 200K. Заточена под агентные задачи и кодинг — 73.8% на SWE-bench Verified. Открытые веса под MIT. Есть лёгкая бесплатная версия GLM-4.7-Flash (31B/3B). Один из сильнейших открытых конкурентов Claude и GPT в кодинге.

Бесплатно (открытые веса, MIT) / API у Z.ai и провайдеровРаботает в РФ
8/10📅 2025-12-22🏢 Zhipu AI✓ Open Source

Рейтинг и бенчмарки

Общий рейтинг
8/10
Benchmark Score
8.1/10
Скорость
8.3/10
Архитектура
MoE 355B / 32B активных
SWE-bench Verified
73.8% (агентный кодинг)
SWE-bench Multilingual
66.7%
Terminal-Bench 2.0
41.0%
Контекст
200K (вывод до 128K)

Входные и выходные данные

Входные данные
текст
Выходные данные
текст

API и стоимость

Входные токены (Input)
Бесплатно (открытые веса, MIT) / API у Z.ai и провайдеров
цена за промпт
API доступен

Способы доступа

API (Z.ai / bigmodel.cn)Self-hosted (Hugging Face)сторонние провайдеры

Сценарии использования

агентное программированиеработа с инструментами и терминаломгенерация UIсложные рассуждениячат

Тарифы и подписки — Zhipu AI

Актуальные планы подписки провайдера. Цены могут меняться — уточняйте на странице цен

Популярный
GLM-4.7-Flash
Бесплатно
  • Лёгкая версия 31B / 3B активных
  • Бесплатные вызовы на платформе Z.ai
  • Открытые веса под MIT
  • Подходит для кодинга и агентов на скромном железе
Открытые веса (self-host)
Бесплатно
  • Флагман 355B и Flash на Hugging Face (MIT)
  • Коммерческое использование без ограничений
  • Запуск через vLLM / SGLang
  • Нужен кластер GPU для 355B
API (Z.ai / провайдеры)
оплата за токены
  • Z.ai (bigmodel.cn), OpenRouter и др.
  • OpenAI-совместимый API
  • Контекст 200K, вывод до 128K
  • Без своего железа
Российские карты не принимаются.Genova-ai — работает в РФ без VPN

Плюсы и минусы

✓ Плюсы
Сильна в агентном кодинге: 73.8% на SWE-bench Verified — один из лучших результатов среди открытых моделей, конкурент Claude и GPT
Открытые веса под MIT — бесплатный запуск и коммерческое использование без ограничений
MoE-эффективность: при 355B总 активны лишь 32B параметров — качество большой модели при разумной стоимости инференса
Контекст 200K и вывод до 128K токенов — большие кодовые базы и длинные ответы
Заточена под инструменты и терминал: улучшенный агентный кодинг, UI-генерация, сложная математика
Есть лёгкая GLM-4.7-Flash (31B / 3B активных) — бесплатна на платформе Z.ai, тоже под MIT
✗ Минусы
Флагман 355B требует кластера GPU для self-host — большинству проще через API или брать Flash-версию
Официальный API Z.ai / bigmodel.cn российские карты не принимает (доступ — через агрегаторы)
Интерфейс и документация преимущественно на английском и китайском
На русском качество ниже, чем у специализированных русскоязычных моделей
Проприетарных мультимодальных возможностей нет — это текстовая модель (для vision у Zhipu отдельная линейка)
Линейка быстро развивается — для нового проекта стоит свериться с актуальной версией GLM

Подробный обзор

Что такое GLM-4.7

GLM-4.7 — флагманская открытая модель китайской лаборатории Zhipu AI (бренд Z.ai), выпущенная 22 декабря 2025 года. Это Mixture-of-Experts на 355 млрд параметров с 32 млрд активных на токен. Главный фокус модели — агентные задачи и программирование: работа с инструментами, терминалом, генерация интерфейсов и сложные многошаговые сценарии. Веса открыты под лицензией MIT, поэтому GLM-4.7 — один из самых мощных открытых конкурентов Claude и GPT, которого можно запускать у себя.

Сильные стороны

  • Агентный кодинг — 73.8% на SWE-bench Verified, 66.7% на многоязычном SWE-bench, 41.0% на Terminal-Bench 2.0
  • Управляемое мышление — режимы Interleaved / Preserved / Turn-level Thinking для более стабильного выполнения сложных задач
  • Большой контекст — 200K токенов на входе и до 128K на выходе
  • Лёгкая версия — GLM-4.7-Flash (31B / 3B активных), бесплатная на платформе Z.ai и тоже под MIT, крутится на скромном железе

Кому подходит

GLM-4.7 — выбор для тех, кому нужен открытый «движок» под AI-агентов и кодинг без привязки к закрытому провайдеру: автономные агенты, работа с репозиториями и терминалом, генерация UI. Флагман 355B требует серьёзного железа, поэтому для локального старта удобна Flash-версия, а для полного качества — API. Линейка GLM активно развивается, так что под новый проект стоит свериться с самой свежей версией.

Доступность в России

Модель доступна в России: это открытые веса под MIT — их можно скачать с Hugging Face и запускать локально без аккаунтов и карт. Если своего железа под 355B нет, проще использовать модель через сторонние API (OpenRouter) или бесплатную Flash-версию на платформе Z.ai. Официальный биллинг Z.ai / bigmodel.cn российские карты не принимает. Русский модель понимает, но эффективнее работает на английском и в кодинге.

Часто задаваемые вопросы

Что такое GLM-4.7?
Флагманская открытая модель Zhipu AI (Z.ai), выпущенная 22 декабря 2025. Это MoE на 355 млрд параметров с 32 млрд активных, заточенная под агентные задачи и кодинг. Веса открыты под лицензией MIT — можно запускать локально и использовать коммерчески. Есть и лёгкая бесплатная версия GLM-4.7-Flash (31B / 3B).
Насколько GLM-4.7 хороша в кодинге?
Очень сильна для открытой модели: 73.8% на SWE-bench Verified (агентный кодинг), 66.7% на многоязычном SWE-bench, 41.0% на Terminal-Bench 2.0. Это уровень, при котором самостоятельно разворачиваемая модель становится реально полезной для кодинг-агентов — конкурент закрытым Claude и GPT.
Сколько стоит GLM-4.7?
Сами веса бесплатны (MIT) — можно скачать с Hugging Face и запускать у себя, в том числе коммерчески. Лёгкая версия GLM-4.7-Flash бесплатно доступна на платформе Z.ai. Флагман через API (Z.ai/bigmodel.cn, сторонние провайдеры вроде OpenRouter) — оплата за токены.
В чём разница между GLM-4.7 и GLM-4.7-Flash?
GLM-4.7 — флагман (355B总 / 32B активных), максимум качества, но требует кластера GPU для self-host. GLM-4.7-Flash — лёгкая версия (31B / 3B активных), бесплатная на Z.ai и под MIT, запускается на скромном железе. Для мощных задач берите флагман, для быстрого и дешёвого старта — Flash.
Работает ли GLM-4.7 в России?
Да — это открытые веса: качаете с Hugging Face и запускаете локально без аккаунтов и карт. Без своего железа подойдут сторонние API (OpenRouter) или бесплатная Flash-версия на Z.ai. Официальный биллинг Z.ai российские карты не принимает. Русский модель понимает, но эффективнее работает на английском и в коде.
Какой у GLM-4.7 контекст?
200 тысяч токенов на входе и до 128 тысяч на выходе — этого хватает на большие кодовые базы, длинные документы и развёрнутые ответы. В сочетании с сильным агентным кодингом это делает модель удобной для работы с крупными репозиториями.

Все эти инструменты — уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно