GLM-4.5

GLM-4.5

Открытая модель Z.ai (28 июля 2025) под свободной лицензией MIT: 355 млрд параметров, из которых на токен работают 32 млрд. Первая в линейке, где рассуждения, программирование и агентные навыки объединены в одной модели. По замерам разработчика уступала только o3 и Grok-4, обходя Claude Opus 4. Сегодня отстала на два поколения от GLM-4.7.

Бесплатно при локальном запуске; API - по тарифам Z.ai и сторонних площадокРаботает в РФ
⭐ 7.6/10📅 2025-07-28🏢 Zhipu AI✓ Open Source

Рейтинг и бенчмарки

Общий рейтинг
7.6/10
Benchmark Score
7.8/10
Скорость
8.3/10
Позиция на момент выхода
3-е место по сводке из 12 тестов замерами Z.ai - позади o3 и Grok-4, впереди Claude Opus 4
Против Kimi K2
53.9% побед
Против Qwen3-Coder
80.8% успешных прохождений
Архитектура
MoE; 355 млрд параметров при 32 млрд активных на токен
Младшая версия
GLM-4.5-Air - 106 млрд всего и 12 млрд активных
Контекст
128 000 токенов
Режимы
с рассуждениями и без - переключаются под задачу
Оговорка
сводка составлена самим разработчиком

Входные и выходные данные

Входные данные
текст
Выходные данные
текст

API и стоимость

Входные токены (Input)
Бесплатно при локальном запуске; API - по тарифам Z.ai и сторонних площадок
цена за промпт
Выходные токены (Output)
бесплатно при локальном запуске
цена за ответ
✓API доступен

Способы доступа

локальный запуск (открытые веса на Hugging Face)API Z.aiсторонние площадки

Сценарии использования

агентные сценарии с вызовом инструментовпрограммированиерассуждения и анализлокальное развертывание в своем контуре

Тарифы и подписки - Zhipu AI

Актуальные планы подписки провайдера. Цены могут меняться - уточняйте на странице цен

Популярный
Локальный запуск
Бесплатно
  • Лицензия MIT - коммерческое использование разрешено
  • Веса на Hugging Face
  • GLM-4.5 - 355 млрд параметров, серверное железо
  • GLM-4.5-Air - 106 млрд, требования ниже
  • Работает без интернета и без VPN
API Z.ai
по тарифам площадки
  • Свое железо не нужно
  • Контекст 128 000 токенов
  • Режимы с рассуждениями и без
  • Нужна зарубежная карта
Российские карты не принимаются.Genova-ai - работает в РФ без VPN

Плюсы и минусы

✓ Плюсы
Свободная лицензия MIT: коммерческое использование, дообучение и продажа продуктов на ее основе разрешены без отчислений и ограничений
Первая модель линейки, где рассуждения, программирование и работа с инструментами объединены в одной модели, а не разнесены по разным
На момент выхода занимала 3-е место по сводке из 12 тестов замерами Z.ai - позади только o3 и Grok-4, при этом впереди Claude Opus 4
Уверенно обходила конкурентов своего времени: 53.9% побед против Kimi K2 и 80.8% успешных прохождений против Qwen3-Coder
Архитектура MoE дает качество 355-миллиардной модели при скорости 32-миллиардной - на токен работает лишь малая часть весов
Есть младшая GLM-4.5-Air на 106 млрд параметров (12 млрд активных) - заметно скромнее по требованиям к железу
Два режима работы: с рассуждениями для сложных задач и быстрый без них для рутины
Открытые веса позволяют развернуть модель в своем контуре - данные не уходят наружу, а из России все работает без VPN
✗ Минусы
Отстала на два поколения: в декабре 2025 вышла GLM-4.7, а линейка уже дошла до GLM-5.2. Для нового проекта брать 4.5 смысла мало
Все приведенные сравнения - сводка самой Z.ai, независимой проверки этих цифр нет
355 млрд параметров означают серверное железо: на домашнем компьютере реалистична только GLM-4.5-Air, да и та требует мощной станции
Только текст: изображения, аудио и видео модель не понимает
Контекст 128 000 токенов - по меркам 2026 года скромно, у конкурентов уже миллион
Российские карты для оплаты API не принимаются, интерфейс и документация без русского языка

Подробный обзор

Что такое GLM-4.5

GLM-4.5 - открытая модель компании Z.ai (до недавнего времени называвшейся Zhipu AI), выпущенная 28 июля 2025 года под свободной лицензией MIT. Вышла в двух размерах:

  • GLM-4.5 - 355 миллиардов параметров, из которых на каждый токен работают 32 миллиарда
  • GLM-4.5-Air - 106 миллиардов, 12 миллиардов активных

Обе используют архитектуру MoE, поддерживают контекст в 128 000 токенов и два режима работы - с рассуждениями для сложных задач и быстрый для рутины.

Чем она была примечательна

Главная идея релиза - объединить рассуждения, программирование и работу с инструментами в одной модели. До этого их обычно разносили: одна модель думает, другая пишет код, третья управляет агентом. GLM-4.5 стала первой в линейке, где все это работает вместе, и компания прямо позиционировала ее как модель под агентные сценарии.

По сводке из 12 тестов, составленной самой Z.ai, модель заняла третье место - позади o3 и Grok-4, но впереди Claude Opus 4. Против прямых конкурентов результаты тоже были убедительными: 53.9% побед над Kimi K2 и 80.8% успешных прохождений против Qwen3-Coder. сводку составлял сам разработчик, независимой проверки у нее нет.

Честно: она устарела

Прошел год, и линейка ушла заметно вперед. В декабре 2025 вышла GLM-4.7, а сегодня актуальна уже GLM-5.2. Контекст в 128 000 токенов, который в июле 2025 выглядел достойно, к 2026 году смотрится скромно - у конкурентов миллион.

Прямая рекомендация: для нового проекта берите свежую версию линейки. GLM-4.5 имеет смысл, только если на нее уже завязан рабочий процесс или если вы специально ищете модель этого размера под конкретное железо.

Что у нее не отнять - лицензия

Лицензия MIT здесь настоящая и без оговорок: можно использовать коммерчески, дообучать, встраивать в продукты и продавать их. Это редкость для модели такого класса - многие "открытые" релизы приходят с ограничениями на коммерческое применение.

С железом надо считаться: 355 миллиардов параметров - это серверный уровень. На своей машине реалистична GLM-4.5-Air, и то нужна мощная станция. Зато развертывание в собственном контуре означает, что данные не уходят наружу, а из России все работает без VPN и без зарубежной карты.

Доступность в России

Открытые веса скачиваются и запускаются без каких-либо ограничений - это самый надежный путь. Если своего железа нет, остается API Z.ai и сторонние площадки, но там понадобится зарубежная карта: российские не принимаются. Русского языка в интерфейсе и документации нет.

Часто задаваемые вопросы

Что такое GLM-4.5?
Открытая модель компании Z.ai (бывшая Zhipu AI), вышедшая 28 июля 2025 года под свободной лицензией MIT. Две версии: GLM-4.5 на 355 миллиардов параметров (32 миллиарда активных) и GLM-4.5-Air на 106 миллиардов (12 миллиардов активных). Контекст 128 000 токенов, два режима - с рассуждениями и без.
Стоит ли использовать GLM-4.5 в 2026 году?
Для нового проекта - вряд ли. В декабре 2025 вышла GLM-4.7, а линейка уже дошла до GLM-5.2. Контекст в 128 000 токенов сегодня выглядит скромно. GLM-4.5 оправдана, только если на нее завязан существующий рабочий процесс или нужна модель именно этого размера под конкретное железо.
Действительно ли у GLM-4.5 свободная лицензия?
Да, MIT без оговорок: коммерческое использование, дообучение, встраивание в продукты и их продажа разрешены без отчислений. Для модели такого класса это редкость - многие "открытые" релизы приходят с ограничениями на коммерческое применение.
Какое железо нужно для GLM-4.5?
Старшая версия на 355 миллиардов параметров требует серверного уровня - дома такое не запустить. Реалистична GLM-4.5-Air на 106 миллиардов (12 миллиардов активных на токен), но и ей нужна мощная рабочая станция. Архитектура MoE помогает: на каждый токен работает лишь малая часть весов.
Работает ли GLM-4.5 в России?
При локальном запуске - полностью, без VPN и без каких-либо ограничений: веса скачиваются с Hugging Face и работают у вас. Для доступа через API Z.ai понадобится зарубежная карта, российские не принимаются. Русского языка в интерфейсе и документации нет.
Чем GLM-4.5 отличалась от предшественниц?
Она первой в линейке объединила рассуждения, программирование и работу с инструментами в одной модели - раньше эти способности разносили по разным. Компания прямо позиционировала ее как модель под агентные сценарии, где нужно и подумать, и написать код, и вызвать внешний инструмент.
Насколько GLM-4.5 была сильна на момент выхода?
По сводке из 12 тестов, составленной самой Z.ai, она заняла третье место - позади o3 и Grok-4, но впереди Claude Opus 4. Против конкурентов своего времени показывала 53.9% побед над Kimi K2 и 80.8% успешных прохождений против Qwen3-Coder. Важно, что эти замеры проводил разработчик, а не независимая сторона.

Все эти инструменты - уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно