База знаний
Qwen (Alibaba) — экосистема open-source мультимодальных моделей
Справочник по экосистеме Qwen от Alibaba Cloud: линейка моделей, мультимодальность, tool use, лицензии, сравнение с Llama и Mistral, где попробовать.
Qwen — экосистема языковых, мультимодальных и агентных моделей и инструментов. Последнее дополнение к семейству — Qwen3.6. При этом в экосистеме продолжают использоваться модели Qwen3.5, Qwen3-Omni, Qwen3-VL, Qwen-Image и специализированные инструменты для речи и агентных сценариев.
Актуальная экосистема
| Семейство или инструмент | Назначение | Подтверждённые актуальные варианты |
| Qwen3.6 | Языковые модели общего назначения и агентное программирование | Qwen3.6-35B-A3B, Qwen3.6-27B |
| Qwen3.5 | Мультимодальные модели на единой vision-language основе | 0.8B, 2B, 4B, 9B, 27B, 35B-A3B, 122B-A10B, 397B-A17B |
| Qwen3-Omni | Понимание текста, аудио, изображений и видео, генерация речи в реальном времени | Qwen3-Omni |
| Qwen3-VL | Публичная серия визуально-языковых моделей | Qwen3-VL |
| Qwen-Image | Генерация и точное редактирование изображений, включая сложный рендеринг текста | Qwen-Image |
| Qwen3-ASR | Многоязычное распознавание речи, музыки и песен, определение языка и временных меток | Qwen3-ASR |
| Qwen-Agent | Агентный фреймворк с function calling, MCP, Code Interpreter и RAG | Открытый фреймворк |
| Qwen Code | Работа с моделями Qwen из терминала | Открытый терминальный агент |
Что изменилось в Qwen3.6
Qwen3.6 — последнее дополнение к семейству Qwen. В апреле 2026 года были выпущены две модели с открытыми весами: Qwen3.6-35B-A3B и Qwen3.6-27B.
Для этого поколения заявлены два заметных улучшения:
- более сильное агентное программирование;
- сохранение контекста рассуждений в истории диалога между сообщениями.
На официальных площадках Qwen3.6 также доступна с adaptive tool use — модель может выбирать и вызывать подключённые инструменты в ходе решения задачи.
Что важно знать о Qwen3.5
Первый выпуск Qwen3.5 включал крупную MoE-модель 397B-A17B. В подтверждённый каталог поколения входят модели 0.8B, 2B, 4B, 9B, 27B, 35B-A3B, 122B-A10B и 397B-A17B.
Qwen3.5 использует единую vision-language основу с ранним слиянием и обучением на мультимодальных токенах. Для поколения заявлена поддержка 201 языка и диалекта.
Мультимодальные направления
Qwen3-Omni — нативная end-to-end omni-модальная модель. Она понимает текст, аудио, изображения и видео и может генерировать речь в реальном времени.
Для задач, сосредоточенных на изображениях и видео, в организации Qwen представлена публичная серия Qwen3-VL. Отдельное направление Qwen-Image предназначено для генерации изображений, сложного рендеринга текста и точного редактирования.
Для обработки звука доступна открытая серия Qwen3-ASR. Она поддерживает многоязычное распознавание речи, музыки и песен, определение языка и работу с временными метками.
Агентные инструменты
Экосистема включает два отдельных открытых инструмента:
- Qwen-Agent — фреймворк с function calling, MCP, Code Interpreter и RAG;
- Qwen Code — терминальный агент, оптимизированный для работы с моделями Qwen.
Qwen-Agent подходит для создания собственных приложений и цепочек инструментов. Qwen Code ориентирован на интерактивную работу с кодом непосредственно из терминала.
Локальный запуск и API
Официально перечислена поддержка Qwen3.6 в Transformers, llama.cpp, MLX, SGLang и vLLM. Это позволяет выбирать среду запуска в зависимости от оборудования и требований проекта.
При развёртывании через SGLang и vLLM для Qwen3.6 указана длина контекста 262 144 токена.
Официальный API Qwen3.6 в Alibaba Cloud Model Studio совместим со спецификациями OpenAI и Anthropic. Это упрощает перенос приложений, уже использующих соответствующие форматы запросов и ответов.
Лицензии
Все актуальные открытые модели, перечисленные в официальном репозитории Qwen3.6, лицензированы под Apache 2.0.
Это утверждение относится именно к моделям, перечисленным в репозитории текущего поколения. Условия исторических и проприетарных выпусков следует проверять по лицензии и модельной карточке конкретной модели.
Как выбрать направление
- Для языковых и агентных задач начните с Qwen3.6.
- Для одновременной работы с текстом, аудио, изображениями и видео используйте Qwen3-Omni.
- Для визуального понимания рассмотрите Qwen3-VL.
- Для генерации или редактирования изображений используйте Qwen-Image.
- Для распознавания речи и другого звукового материала рассмотрите Qwen3-ASR.
- Для собственного агентного приложения используйте Qwen-Agent, а для терминального сценария — Qwen Code.
Официальные источники
Если хотите разобрать свою задачу — напишите мне Если хотите разобрать свою задачу — напишите мне.
Можно прийти с идеей, черновым контекстом или уже живой задачей. Помогу быстро понять, где реальный следующий шаг, а где лишний шум.
Обычно хватает 2–3 сообщений, чтобы понять, могу ли я здесь реально помочь и в каком формате лучше двигаться дальше.
Дальше по теме
NeuralDeep: российская AI-инфраструктура on-prem. Чат с OSS-моделями, OpenAI-совместимое API, браузерный IDE, сеть агентов, RAG-поиск и каталог скиллов.