Версии Qwen
Alibaba держит линейку моделей: одна экономит на скорости, другая тянет омнимодальные запросы, третья доступна с открытыми весами.
Вся линейка на API-платформе
| Модель | Роль |
|---|---|
| Qwen3.8-Max | Флагман: текст, рассуждение, код |
| Qwen3.7-Plus | Баланс качества и скорости |
| Qwen3.7-Flash | Самый быстрый и дешёвый вариант |
| Qwen3.5-Omni-Plus | Текст, изображение, аудио и видео |
| Qwen-Image-3.0-Pro | Генерация и редактирование изображений |
| Qwen-Audio-3.0 | Синтез и распознавание речи |
Qwen3.8-Max — флагман
Актуальная модель линейки: способна вести рассуждение, писать код и разбирать длинные запросы без падения качества к концу ответа.
Закрытая: веса не публикуются, доступ только через API или Qwen Chat.
Plus и Flash
Qwen3.7-Plus — компромисс между качеством и ценой запроса. Qwen3.7-Flash быстрее и дешевле обоих, годится для задач, где важна скорость ответа, а не глубина рассуждения.
Открытые веса
Часть линейки Alibaba выкладывает целиком: код и параметры лежат в открытом доступе, их можно скачать и запустить на своём железе.
Qwen3.8-27B
27,8 млрд параметров, мультимодальная
Понимает изображения и текст. Доступны сборки в GGUF от сообщества, модель совместима с Ollama, llama.cpp, LM Studio и MLX.
Qwen3.8-2.4T-A95B
MoE, 2,4 трлн параметров, 95 млрд активных
Самая крупная открытая модель линейки: на каждый токен активируется 95 миллиардов параметров — отсюда обозначение A95B. Для запуска целиком нужен кластер, но квантизации урезают требования.
Дальше по теме
Сравнить версии проще на своей задаче
В Qwen Chat можно переключать модель прямо в диалоге.