pimenov.ai

База знаний

Qwen (Alibaba) — экосистема open-source мультимодальных моделей

Справочник по экосистеме Qwen от Alibaba Cloud: линейка моделей, мультимодальность, tool use, лицензии, сравнение с Llama и Mistral, где попробовать.

Опубликовано Обновлено

Qwen — экосистема языковых, мультимодальных и агентных моделей и инструментов. Последнее дополнение к семейству — Qwen3.6. При этом в экосистеме продолжают использоваться модели Qwen3.5, Qwen3-Omni, Qwen3-VL, Qwen-Image и специализированные инструменты для речи и агентных сценариев.


Актуальная экосистема

Семейство или инструментНазначениеПодтверждённые актуальные варианты
Qwen3.6Языковые модели общего назначения и агентное программированиеQwen3.6-35B-A3B, Qwen3.6-27B
Qwen3.5Мультимодальные модели на единой vision-language основе0.8B, 2B, 4B, 9B, 27B, 35B-A3B, 122B-A10B, 397B-A17B
Qwen3-OmniПонимание текста, аудио, изображений и видео, генерация речи в реальном времениQwen3-Omni
Qwen3-VLПубличная серия визуально-языковых моделейQwen3-VL
Qwen-ImageГенерация и точное редактирование изображений, включая сложный рендеринг текстаQwen-Image
Qwen3-ASRМногоязычное распознавание речи, музыки и песен, определение языка и временных метокQwen3-ASR
Qwen-AgentАгентный фреймворк с function calling, MCP, Code Interpreter и RAGОткрытый фреймворк
Qwen CodeРабота с моделями Qwen из терминалаОткрытый терминальный агент

Что изменилось в Qwen3.6

Qwen3.6 — последнее дополнение к семейству Qwen. В апреле 2026 года были выпущены две модели с открытыми весами: Qwen3.6-35B-A3B и Qwen3.6-27B.

Для этого поколения заявлены два заметных улучшения:

  • более сильное агентное программирование;
  • сохранение контекста рассуждений в истории диалога между сообщениями.

На официальных площадках Qwen3.6 также доступна с adaptive tool use — модель может выбирать и вызывать подключённые инструменты в ходе решения задачи.


Что важно знать о Qwen3.5

Первый выпуск Qwen3.5 включал крупную MoE-модель 397B-A17B. В подтверждённый каталог поколения входят модели 0.8B, 2B, 4B, 9B, 27B, 35B-A3B, 122B-A10B и 397B-A17B.

Qwen3.5 использует единую vision-language основу с ранним слиянием и обучением на мультимодальных токенах. Для поколения заявлена поддержка 201 языка и диалекта.


Мультимодальные направления

Qwen3-Omni — нативная end-to-end omni-модальная модель. Она понимает текст, аудио, изображения и видео и может генерировать речь в реальном времени.

Для задач, сосредоточенных на изображениях и видео, в организации Qwen представлена публичная серия Qwen3-VL. Отдельное направление Qwen-Image предназначено для генерации изображений, сложного рендеринга текста и точного редактирования.

Для обработки звука доступна открытая серия Qwen3-ASR. Она поддерживает многоязычное распознавание речи, музыки и песен, определение языка и работу с временными метками.


Агентные инструменты

Экосистема включает два отдельных открытых инструмента:

  • Qwen-Agent — фреймворк с function calling, MCP, Code Interpreter и RAG;
  • Qwen Code — терминальный агент, оптимизированный для работы с моделями Qwen.

Qwen-Agent подходит для создания собственных приложений и цепочек инструментов. Qwen Code ориентирован на интерактивную работу с кодом непосредственно из терминала.


Локальный запуск и API

Официально перечислена поддержка Qwen3.6 в Transformers, llama.cpp, MLX, SGLang и vLLM. Это позволяет выбирать среду запуска в зависимости от оборудования и требований проекта.

При развёртывании через SGLang и vLLM для Qwen3.6 указана длина контекста 262 144 токена.

Официальный API Qwen3.6 в Alibaba Cloud Model Studio совместим со спецификациями OpenAI и Anthropic. Это упрощает перенос приложений, уже использующих соответствующие форматы запросов и ответов.


Лицензии

Все актуальные открытые модели, перечисленные в официальном репозитории Qwen3.6, лицензированы под Apache 2.0.

Это утверждение относится именно к моделям, перечисленным в репозитории текущего поколения. Условия исторических и проприетарных выпусков следует проверять по лицензии и модельной карточке конкретной модели.


Как выбрать направление

  • Для языковых и агентных задач начните с Qwen3.6.
  • Для одновременной работы с текстом, аудио, изображениями и видео используйте Qwen3-Omni.
  • Для визуального понимания рассмотрите Qwen3-VL.
  • Для генерации или редактирования изображений используйте Qwen-Image.
  • Для распознавания речи и другого звукового материала рассмотрите Qwen3-ASR.
  • Для собственного агентного приложения используйте Qwen-Agent, а для терминального сценария — Qwen Code.

Официальные источники