Qwen3.8-Max

Qwen3.8-Max

Самая большая модель Alibaba (3 августа 2026): 2.4 трлн параметров MoE, контекст 1M и впервые у линейки Max — понимание картинок и видео. Лидирует в следовании инструкциям (IFBench 82.8 против 62-73 у конкурентов) и исследовательских задачах (PaperBench 93.0), но уступает Fable 5 в сложном кодинге. Дешевле предшественницы: $2 / $6 за 1M.

API $2.00 / $6.00 за 1M токенов (кешированный вход $0.25)Нужен VPN
9/10📅 2026-08-03🏢 Alibaba (Qwen)Proprietary

Рейтинг и бенчмарки

Общий рейтинг
9/10
Benchmark Score
9/10
Скорость
8.2/10
IFBench
82.8 — уверенно впереди всех (Opus 4.8 — 62.2, Fable 5 — 63.5, GPT-5.6 Sol — 72.7)
PaperBench
93.0 против 80.3 у Opus 4.8 и 88.8 у Fable 5
Terminal-Bench 2.1
86.6 — выше обеих моделей Claude (84.6), но ниже GPT-5.6 Sol (88.8)
GPQA Diamond
92.6 — вровень с Fable 5, чуть ниже GPT-5.6 Sol (94.1)
SWE-bench Pro
67.7 — заметно ниже Fable 5 (80.0), слабое место модели
HLE (Humanity's Last Exam)
43.6 — последнее место в своей группе (у Fable 5 53.3)
OSWorld-Verified
86.1 (работа с компьютером)
MathVision
95.2 (математика по картинкам)

Входные и выходные данные

Входные данные
текстизображениявидео
Выходные данные
текст

API и стоимость

Входные токены (Input)
API $2.00 / $6.00 за 1M токенов (кешированный вход $0.25)
цена за промпт
Выходные токены (Output)
$6.00 / 1M токенов
цена за ответ
API доступен

Способы доступа

API (Alibaba Cloud Model Studioсовместим с OpenAI и DashScope)агент QwenWork

Сценарии использования

агентное программированиеработа в терминалеисследования и анализ документовзадачи с картинками и видеодлинный контексткорпоративная автоматизация

Тарифы и подписки — Alibaba (Qwen)

Актуальные планы подписки провайдера. Цены могут меняться — уточняйте на странице цен

Популярный
API (Alibaba Cloud Model Studio)
$2.00 / $6.00 за 1M
  • Вход $2.00, выход $6.00 за 1M токенов
  • Кешированный вход — $0.25 за 1M (в 8 раз дешевле)
  • Контекст 1M, вывод до 131 072 токенов
  • Текст, изображения и видео на вход
  • Совместимость с API OpenAI и DashScope
Российские карты не принимаются.Genova-ai — работает в РФ без VPN

Плюсы и минусы

✓ Плюсы
Лучшее в своём классе следование инструкциям: IFBench 82.8 против 62.2 у Claude Opus 4.8 и 72.7 у GPT-5.6 Sol — отрыв огромный, а для агентов и автоматизации это важнее красивых цифр на других тестах
Сильна в исследовательских задачах: PaperBench 93.0 — выше всех конкурентов, включая Fable 5 (88.8)
Впервые у линейки Max есть мультимодальность: понимает изображения и видео, а не только текст как Qwen 3.7 Max
Огромный скачок по мультимодальному кодингу: FrontierSWE вырос с 40.7 до 73.5 за одно поколение
Контекст 1 млн токенов, вывод до 131 072 и до 262K токенов на рассуждения — целые кодовые базы и часовые видео
Подешевела относительно предшественницы: $2.00 / $6.00 за 1M против $2.50 / $7.50 у Qwen 3.7 Max, кешированный вход — $0.25
API совместим с форматом OpenAI — перевести существующий код можно сменой адреса и ключа
Alibaba заявила о планах открыть веса, а младшую Qwen3.8-27B обещает выложить для локального запуска
✗ Минусы
Сложный кодинг — слабое место: SWE-bench Pro 67.7 против 80.0 у Fable 5 и 69.2 у Opus 4.8. Для тяжёлых задач по починке реального кода это не лучший выбор
Худший результат в группе на самом трудном тесте HLE: 43.6 против 53.3 у Fable 5 и 47.2 у GPT-5.6 Sol
Все опубликованные цифры — замеры самой Alibaba. Независимой проверки на момент выхода нет, а вендорские бенчмарки исторически оптимистичны
Открытые веса пока только обещание без даты и названия лицензии — рассчитывать на локальный запуск рано
Не работает в России без VPN и не принимает российские карты — оплата через Alibaba Cloud
Заявление про 16 дней автономной работы над проектом — из внутреннего тестирования Alibaba, воспроизводимых условий компания не приводила

Подробный обзор

Что такое Qwen3.8-Max

Qwen3.8-Max — самая большая модель Alibaba за всю историю, представленная 3 августа 2026 года. В ней 2.4 триллиона параметров в архитектуре MoE (сколько из них активны при одном запросе, компания не раскрыла), контекст в 1 миллион токенов и вывод до 131 072 токенов. Главное отличие от Qwen 3.7 Max: старшая модель наконец научилась видеть — принимает на вход изображения и видео, а не только текст.

В чём она реально сильна

Пресса подала релиз как «Alibaba догнала Anthropic», но таблица бенчмарков рисует более интересную картину — модель не побеждает везде, зато выигрывает там, где это заметно на практике.

  • Следование инструкциям — IFBench 82.8, тогда как у Claude Opus 4.8 всего 62.2, у Fable 5 — 63.5, у GPT-5.6 Sol — 72.7. Это самый большой отрыв во всей таблице. Если модель работает в автоматическом сценарии и должна точно соблюдать формат ответа и правила, такой результат стоит дороже пары очков на других тестах
  • Исследовательские задачи — PaperBench 93.0 против 80.3 у Opus 4.8 и 88.8 у Fable 5
  • Работа в терминале — Terminal-Bench 2.1 86.6: выше обеих моделей Claude (по 84.6), но ниже GPT-5.6 Sol (88.8)
  • Наука — GPQA Diamond 92.6, вровень с Fable 5
  • Мультимодальность — MathVision 95.2, OSWorld-Verified 86.1, а FrontierSWE вырос с 40.7 до 73.5 за одно поколение

Где она проигрывает

Честно про слабые места, потому что они существенные. На SWE-bench Pro — тесте на починку реального кода в больших проектах — Qwen3.8-Max набирает 67.7 против 80.0 у Claude Fable 5 и уступает даже Opus 4.8 (69.2). На самом трудном экзамене HLE результат 43.6 — последнее место в своей группе. То есть для тяжёлой отладки чужого кода и задач на пределе человеческих знаний это не первый выбор.

Отдельно стоит держать в голове: все эти цифры замеряла сама Alibaba. На момент публикации независимых проверок не было, а вендорские бенчмарки почти всегда получаются оптимистичнее — компания сама выбирает промпты, настройки и число попыток.

Цена и доступ

Модель подешевела относительно предшественницы: $2.00 за миллион входных токенов и $6.00 за миллион выходных против $2.50 / $7.50 у Qwen 3.7 Max. Кешированный вход стоит $0.25 — в восемь раз дешевле обычного, что заметно экономит на длинных диалогах с одинаковым началом. Доступ идёт через Alibaba Cloud Model Studio, причём API совместим с форматом OpenAI: перевести существующий код можно сменой адреса и ключа. Модель также встроена в офисного агента QwenWork.

Откроют ли веса

Alibaba заявила о намерении опубликовать веса Qwen3.8-Max и выложить младшую Qwen3.8-27B для локального запуска. Если обещание выполнят, это станет самой мощной открытой моделью в мире. Но пока это именно обещание: ни точной даты, ни названия лицензии компания не назвала, а прошлый флагман Qwen 3.7 Max так и остался закрытым. Планировать инфраструктуру под локальный запуск рано — если нужны открытые веса прямо сейчас, работают проверенные Qwen 3 и Qwen3-Coder под Apache 2.0.

Доступность в России

Напрямую модель в России не работает: Alibaba Cloud требует зарубежного аккаунта и не принимает российские карты, так что понадобится VPN и иностранный способ оплаты либо посредник. Российской локализации интерфейса нет — документация на английском и китайском. Если нужна модель Qwen без этих барьеров, остаются открытые Qwen 3 и Qwen3-Coder, которые можно запустить на своём железе.

Часто задаваемые вопросы

Что такое Qwen3.8-Max?
Самая большая модель Alibaba, выпущенная 3 августа 2026 года: 2.4 триллиона параметров в архитектуре MoE, контекст 1 миллион токенов, вывод до 131 072 токенов. В отличие от Qwen 3.7 Max понимает не только текст, но и изображения с видео. Доступна через API Alibaba Cloud и офисного агента QwenWork.
Qwen3.8-Max действительно обходит Claude и GPT?
Частично. Она уверенно лидирует в следовании инструкциям (IFBench 82.8 против 62.2 у Opus 4.8) и в исследовательских задачах (PaperBench 93.0). Но на сложном кодинге проигрывает: SWE-bench Pro 67.7 против 80.0 у Claude Fable 5. На тесте HLE у неё худший результат в группе — 43.6. Плюс все цифры замеряла сама Alibaba, независимых проверок на момент выхода не было.
Сколько стоит Qwen3.8-Max?
$2.00 за миллион входных токенов и $6.00 за миллион выходных — дешевле предшественницы Qwen 3.7 Max ($2.50 / $7.50). Кешированный вход стоит всего $0.25 за миллион, в восемь раз дешевле обычного, что заметно экономит при длинных диалогах с повторяющимся началом.
Открыты ли веса Qwen3.8-Max?
Пока нет. Alibaba заявила о планах открыть веса и выложить младшую Qwen3.8-27B для локального запуска, но ни даты, ни лицензии не назвала. Прошлый флагман Qwen 3.7 Max так и остался закрытым, поэтому рассчитывать на локальный запуск рано. Открытые Qwen 3 и Qwen3-Coder под Apache 2.0 доступны уже сейчас.
Работает ли Qwen3.8-Max в России?
Не напрямую. Доступ идёт через Alibaba Cloud, который требует зарубежного аккаунта и не принимает российские карты — нужен VPN и иностранный способ оплаты либо посредник. Русской локализации нет, документация на английском и китайском.
Правда ли модель 16 дней самостоятельно вела проект?
Такое заявление Alibaba сделала по итогам внутреннего тестирования — модель, по словам компании, самостоятельно выполнила программный проект за 16 дней. Условия эксперимента и способ его воспроизведения компания не публиковала, так что проверить это независимо нельзя.
Чем Qwen3.8-Max отличается от Qwen 3.7 Max?
Три главных отличия: появилась мультимодальность (изображения и видео на входе — прошлая Max была только текстовой), вырос вывод с 65 536 до 131 072 токенов и снизилась цена. По бенчмаркам прирост крупный: PaperBench с 64.8 до 93.0, Terminal-Bench с 74.5 до 86.6, FrontierSWE с 40.7 до 73.5.
Для каких задач стоит выбрать Qwen3.8-Max?
Для автоматизации и агентов, где важно точное соблюдение инструкций и формата ответа — здесь у неё лучший результат в отрасли. Для анализа исследований и длинных документов, работы в терминале, задач с картинками и видео. А вот для тяжёлой отладки чужого кода лучше взять Claude Fable 5.

Все эти инструменты — уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно