GLM-4.7
Флагманская открытая модель Zhipu AI (Z.ai), 22 декабря 2025: MoE на 355B с 32B активных, контекст 200K. Заточена под агентные задачи и кодинг — 73.8% на SWE-bench Verified. Открытые веса под MIT. Есть лёгкая бесплатная версия GLM-4.7-Flash (31B/3B). Один из сильнейших открытых конкурентов Claude и GPT в кодинге.
Рейтинг и бенчмарки
Входные и выходные данные
API и стоимость
Способы доступа
Сценарии использования
Тарифы и подписки — Zhipu AI
Актуальные планы подписки провайдера. Цены могут меняться — уточняйте на странице цен
- Лёгкая версия 31B / 3B активных
- Бесплатные вызовы на платформе Z.ai
- Открытые веса под MIT
- Подходит для кодинга и агентов на скромном железе
- Флагман 355B и Flash на Hugging Face (MIT)
- Коммерческое использование без ограничений
- Запуск через vLLM / SGLang
- Нужен кластер GPU для 355B
- Z.ai (bigmodel.cn), OpenRouter и др.
- OpenAI-совместимый API
- Контекст 200K, вывод до 128K
- Без своего железа
Плюсы и минусы
Подробный обзор
Что такое GLM-4.7
GLM-4.7 — флагманская открытая модель китайской лаборатории Zhipu AI (бренд Z.ai), выпущенная 22 декабря 2025 года. Это Mixture-of-Experts на 355 млрд параметров с 32 млрд активных на токен. Главный фокус модели — агентные задачи и программирование: работа с инструментами, терминалом, генерация интерфейсов и сложные многошаговые сценарии. Веса открыты под лицензией MIT, поэтому GLM-4.7 — один из самых мощных открытых конкурентов Claude и GPT, которого можно запускать у себя.
Сильные стороны
- Агентный кодинг — 73.8% на SWE-bench Verified, 66.7% на многоязычном SWE-bench, 41.0% на Terminal-Bench 2.0
- Управляемое мышление — режимы Interleaved / Preserved / Turn-level Thinking для более стабильного выполнения сложных задач
- Большой контекст — 200K токенов на входе и до 128K на выходе
- Лёгкая версия — GLM-4.7-Flash (31B / 3B активных), бесплатная на платформе Z.ai и тоже под MIT, крутится на скромном железе
Кому подходит
GLM-4.7 — выбор для тех, кому нужен открытый «движок» под AI-агентов и кодинг без привязки к закрытому провайдеру: автономные агенты, работа с репозиториями и терминалом, генерация UI. Флагман 355B требует серьёзного железа, поэтому для локального старта удобна Flash-версия, а для полного качества — API. Линейка GLM активно развивается, так что под новый проект стоит свериться с самой свежей версией.
Доступность в России
Модель доступна в России: это открытые веса под MIT — их можно скачать с Hugging Face и запускать локально без аккаунтов и карт. Если своего железа под 355B нет, проще использовать модель через сторонние API (OpenRouter) или бесплатную Flash-версию на платформе Z.ai. Официальный биллинг Z.ai / bigmodel.cn российские карты не принимает. Русский модель понимает, но эффективнее работает на английском и в кодинге.