Версии Qwen: чем 3.8-Max отличается от остальных
Alibaba держит не одну модель, а линейку: одна экономит на скорости, другая тянет омнимодальные запросы, третья существует только как открытые веса.
Вся линейка на API-платформе
Данные из документации Alibaba Cloud Model Studio.
| Модель | Роль |
|---|---|
| Qwen3.8-Max | Флагман: текст, рассуждение, код |
| Qwen3.7-Plus | Баланс качества и скорости |
| Qwen3.7-Flash | Самый быстрый и дешёвый уровень |
| Qwen3.5-Omni-Plus | Текст, изображение, аудио и видео разом |
| Qwen-Image-3.0-Pro | Генерация и редактирование изображений |
| Qwen-Audio-3.0 | Синтез и распознавание речи |
Qwen3.8-Max — флагман
Старшая модель линейки: держит рассуждение, код и длинные запросы без падения качества к концу ответа. Именно её Alibaba выставляет как витрину линейки и ставит в сравнения с закрытыми моделями.
Закрытая: веса не публикуются, доступ только через API или Qwen Chat.
Plus и Flash
Qwen3.7-Plus — компромисс между качеством и ценой запроса. Qwen3.7-Flash быстрее и дешевле обоих, годится для задач, где важна скорость ответа, а не глубина рассуждения.
Открытые веса — не то же самое, что API
Часть линейки Alibaba выкладывает целиком: код и параметры лежат в открытом доступе, их можно скачать и запустить на своём железе.
Qwen3.8-27B
27,8 млрд параметров, мультимодальная
Понимает изображения и текст в одном запросе. Community-сборки в GGUF есть уже в первые часы после релиза — модель совместима с Ollama, llama.cpp, LM Studio и MLX.
Qwen3.8-2.4T-A95B
MoE, 2,4 трлн параметров, 95 млрд активных
Самая крупная открытая модель линейки: на каждый токен считает не всю сеть, а только активную часть — отсюда обозначение A95B. Для запуска целиком нужен кластер, но квантизации урезают требования.
Подробный разбор запуска — на странице о локальном запуске.
Почему в поиске всё ещё мелькает Qwen 3.0 и 2.5
Нумерация у Qwen не одна прямая линия. Текстовые модели дошли до 3.8, но омнимодальная ветка держит собственный номер — Qwen3.5-Omni-Plus — и не обязана совпадать с версией текстовой модели рядом. Старые релизы вроде Qwen2.5 при этом никуда не делись: они остаются в истории на Hugging Face, и запросы по ним не исчезают из поиска даже после выхода новых версий.
Как не запутаться
Смотреть не на номер сам по себе, а на то, что стоит рядом: -Max и -Plus — API-модели без открытых весов, голое число вроде 3.8-27B — открытая модель на Hugging Face.
Дальше по теме
Сравнить версии проще на своей задаче
В Qwen Chat можно переключать модель прямо в диалоге.