Qwen Ru Открыть Qwen

Версии Qwen: чем 3.8-Max отличается от остальных

Alibaba держит не одну модель, а линейку: одна экономит на скорости, другая тянет омнимодальные запросы, третья существует только как открытые веса.

6 моделей на API-платформе2 модели в открытом доступе

Вся линейка на API-платформе

Данные из документации Alibaba Cloud Model Studio.

Модели Qwen на платформе Alibaba Cloud Model Studio
МодельРоль
Qwen3.8-Max Флагман: текст, рассуждение, код
Qwen3.7-Plus Баланс качества и скорости
Qwen3.7-Flash Самый быстрый и дешёвый уровень
Qwen3.5-Omni-Plus Текст, изображение, аудио и видео разом
Qwen-Image-3.0-Pro Генерация и редактирование изображений
Qwen-Audio-3.0 Синтез и распознавание речи

Qwen3.8-Max — флагман

Старшая модель линейки: держит рассуждение, код и длинные запросы без падения качества к концу ответа. Именно её Alibaba выставляет как витрину линейки и ставит в сравнения с закрытыми моделями.

Закрытая: веса не публикуются, доступ только через API или Qwen Chat.

Plus и Flash

Qwen3.7-Plus — компромисс между качеством и ценой запроса. Qwen3.7-Flash быстрее и дешевле обоих, годится для задач, где важна скорость ответа, а не глубина рассуждения.

Открытые веса — не то же самое, что API

Часть линейки Alibaba выкладывает целиком: код и параметры лежат в открытом доступе, их можно скачать и запустить на своём железе.

Qwen3.8-27B

27,8 млрд параметров, мультимодальная

Понимает изображения и текст в одном запросе. Community-сборки в GGUF есть уже в первые часы после релиза — модель совместима с Ollama, llama.cpp, LM Studio и MLX.

Qwen3.8-2.4T-A95B

MoE, 2,4 трлн параметров, 95 млрд активных

Самая крупная открытая модель линейки: на каждый токен считает не всю сеть, а только активную часть — отсюда обозначение A95B. Для запуска целиком нужен кластер, но квантизации урезают требования.

Подробный разбор запуска — на странице о локальном запуске.

Почему в поиске всё ещё мелькает Qwen 3.0 и 2.5

Нумерация у Qwen не одна прямая линия. Текстовые модели дошли до 3.8, но омнимодальная ветка держит собственный номер — Qwen3.5-Omni-Plus — и не обязана совпадать с версией текстовой модели рядом. Старые релизы вроде Qwen2.5 при этом никуда не делись: они остаются в истории на Hugging Face, и запросы по ним не исчезают из поиска даже после выхода новых версий.

Как не запутаться

Смотреть не на номер сам по себе, а на то, что стоит рядом: -Max и -Plus — API-модели без открытых весов, голое число вроде 3.8-27B — открытая модель на Hugging Face.

Дальше по теме

Сравнить версии проще на своей задаче

В Qwen Chat можно переключать модель прямо в диалоге.