Qwen 3

Qwen 3

Открытое семейство моделей Alibaba (апрель 2025) под лицензией Apache 2.0 — от 0.6B для телефонов до MoE-флагмана 235B с 22B активных. Гибридный режим мышления переключается прямо в запросе, контекст до 128K (у старших — 256K). Одна из самых сильных и свободных открытых линеек: запускается локально бесплатно.

Бесплатно (открытые веса, Apache 2.0) / API у провайдеровРаботает в РФ
8.2/10📅 2025-04🏢 Alibaba (Qwen)✓ Open Source

Рейтинг и бенчмарки

Общий рейтинг
8.2/10
Benchmark Score
8.2/10
Скорость
8.5/10
Линейка
6 dense (0.6B–32B) + 2 MoE (30B-A3B, 235B-A22B)
Флагман 235B-A22B
AIME 2024 85.7, LiveCodeBench 70.7, GPQA 71.1
Гибридное мышление
режим рассуждений включается прямо в запросе
Лицензия
Apache 2.0 — без ограничений по использованию

Входные и выходные данные

Входные данные
текст
Выходные данные
текст

API и стоимость

Входные токены (Input)
Бесплатно (открытые веса, Apache 2.0) / API у провайдеров
цена за промпт
API доступен

Способы доступа

Self-hosted (Hugging FaceOllamaLM Studio)API (Alibaba CloudOpenRouter и др.)чат qwen.ai

Сценарии использования

чат и письмопрограммированиематематика и рассуждениялокальный запуск на своём железедообучение под свои задачи

Тарифы и подписки — Alibaba (Qwen)

Актуальные планы подписки провайдера. Цены могут меняться — уточняйте на странице цен

Популярный
Открытые веса (self-host)
Бесплатно
  • Все размеры на Hugging Face под Apache 2.0
  • Коммерческое использование без ограничений
  • Запуск через Ollama / LM Studio / vLLM
  • Можно дообучать под свои задачи
Чат qwen.ai
Бесплатно
  • Официальный веб-чат Qwen
  • Без своего железа
  • Доступ к старшим моделям линейки
API (провайдеры)
оплата за токены
  • Alibaba Cloud, OpenRouter, Together AI и др.
  • OpenAI-совместимый API
  • Без собственного GPU
Российские карты не принимаются.Genova-ai — работает в РФ без VPN

Плюсы и минусы

✓ Плюсы
Полностью свободная лицензия Apache 2.0 — без ограничений на коммерческое использование, самая дружелюбная среди крупных китайских лабораторий
Линейка под любое железо: от 0.6B и 1.7B для телефонов и edge до 32B и MoE-флагмана 235B-A22B для серверов
Гибридный режим мышления — рассуждения можно включать и выключать прямо в запросе, не меняя модель
MoE-эффективность: у 30B-A3B активны всего 3B параметров, у 235B-A22B — 22B, поэтому инференс дешевле плотных моделей
Флагман на уровне сильных закрытых моделей: AIME 2024 85.7, LiveCodeBench 70.7, GPQA 71.1
Работает в России без ограничений: веса качаются с Hugging Face и запускаются локально без аккаунтов и карт
✗ Минусы
Линейка ушла далеко вперёд — вышли Qwen3.5 и более свежие версии; для нового проекта сверяйтесь с актуальной
Флагман 235B требует серьёзного железа — на одной потребительской видеокарте не запустить
Официальный облачный доступ через Alibaba Cloud российские карты не принимает
Интерфейс и документация на английском и китайском, русского интерфейса нет
На русском качество ниже, чем на английском и китайском
Только текст: для изображений, аудио и видео есть отдельные подсемейства (Qwen3-VL, Qwen3-Omni)

Подробный обзор

Что такое Qwen 3

Qwen 3 — поколение открытых моделей от Alibaba, представленное в апреле 2025 года. Это не одна модель, а целое семейство под лицензией Apache 2.0: шесть «плотных» моделей от 0.6B до 32B параметров и две Mixture-of-Experts — 30B-A3B (30 млрд总, 3 млрд активных) и флагман 235B-A22B (235 млрд总, 22 млрд активных). Такой разброс покрывает всё: от телефонов и ноутбуков до серверов.

Гибридное мышление и качество

Ключевая особенность Qwen 3 — переключаемый режим рассуждений: одна и та же модель может отвечать сразу или сначала «подумать», и режим задаётся прямо в запросе. Это удобно: не нужно держать отдельную reasoning-модель. По качеству флагман 235B-A22B на старте обходил o3-mini на математических тестах AIME и в задачах Codeforces, а на ряде reasoning-бенчмарков был сопоставим с Gemini 2.5 Pro: AIME 2024 — 85.7, LiveCodeBench — 70.7, GPQA — 71.1.

Почему лицензия важна

Qwen 3 распространяется под Apache 2.0 — без оговорок про число пользователей и без ограничений по сферам применения. Это самая свободная лицензия среди крупных открытых линеек, поэтому Qwen активно берут в коммерческие продукты и дообучают под свои задачи. Вокруг семейства выросла целая экосистема: Qwen3-Coder для кода, Qwen3-VL для изображений, Qwen3-Omni для аудио и видео.

Актуальность

Qwen 3 остаётся крепкой рабочей линейкой, но развивается она очень быстро: уже вышли更 свежие поколения (включая Qwen3.5 и специализированные подсемейства). Если нужен максимум качества — стоит свериться с актуальной версией; если нужна проверенная, широко поддержанная линейка под локальный запуск — Qwen 3 отлично подходит и сегодня.

Доступность в России

Модели работают в России без ограничений — это открытые веса под Apache 2.0: скачиваете с Hugging Face (иногда нужен VPN для стабильной загрузки) и запускаете локально через Ollama, LM Studio или vLLM, без аккаунтов и карт. Есть и официальный веб-чат qwen.ai. Барьер только в оплате облачного API Alibaba Cloud — российские карты там не принимают, поэтому проще использовать сторонние агрегаторы вроде OpenRouter. Русский язык модель понимает, но точнее работает на английском.

Часто задаваемые вопросы

Что такое Qwen 3?
Семейство открытых моделей Alibaba (апрель 2025) под лицензией Apache 2.0: шесть плотных моделей от 0.6B до 32B параметров плюс две MoE — 30B-A3B и флагман 235B-A22B. Есть переключаемый режим рассуждений, контекст до 128K. Веса открыты, можно запускать локально и использовать коммерчески.
Qwen 3 действительно бесплатна?
Да, веса открыты под Apache 2.0 — самой свободной лицензией среди крупных открытых линеек: без ограничений по числу пользователей и сферам применения. Скачиваете с Hugging Face и запускаете у себя бесплатно, в том числе в коммерческих продуктах. Платить нужно только за чужой хостинг (Alibaba Cloud, OpenRouter и т.п.).
Какую версию Qwen 3 выбрать?
Зависит от железа: 0.6B и 1.7B — для телефонов и edge, 4B–8B — для ноутбука, 14B–32B — для хорошей видеокарты. MoE-версия 30B-A3B даёт качество крупной модели при активных 3B параметрах — отличный баланс. Флагман 235B-A22B требует серверного железа. Для локального старта чаще всего берут 8B или 30B-A3B.
Что такое гибридный режим мышления?
Это возможность включать и выключать цепочку рассуждений прямо в запросе, не меняя модель. На простых вопросах Qwen 3 отвечает сразу и быстро, на сложных — сначала «думает». Удобно тем, что не нужно держать отдельную reasoning-модель для сложных задач.
Работает ли Qwen 3 в России?
Да, без ограничений — это открытые веса: качаете с Hugging Face и запускаете локально через Ollama, LM Studio или vLLM без аккаунтов и карт. Есть и веб-чат qwen.ai. Единственный барьер — оплата облачного API Alibaba Cloud, где российские карты не принимают; обходится через агрегаторы вроде OpenRouter.
Qwen 3 актуальна в 2026 году?
Это по-прежнему крепкая и широко поддержанная линейка, особенно для локального запуска: её поддерживают все популярные инструменты. Но семейство развивается очень быстро — уже вышли более свежие поколения (включая Qwen3.5) и специализированные подсемейства (Qwen3-Coder для кода, Qwen3-VL для изображений). Для максимума качества стоит свериться с актуальной версией.

Все эти инструменты — уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно