pimenov.ai

Qwen-Image-2.1: генерация и редактирование изображений на своём компьютере

Alibaba выпустила Qwen-Image-2.1 — модель для генерации и редактирования изображений, которую можно запускать локально. Веса доступны для скачивания, а поддержка уже есть в ComfyUI. В этом посте — три изображения со мной, сделанные в Qwen-Image-2.1.

Одна из самых полезных возможностей — настоящая прозрачность. Модель умеет создавать изображения с альфа-каналом, редактировать прозрачные слои и извлекать объекты из фотографий. Например, можно получить человека или предмет на прозрачном фоне для дальнейшего монтажа.

В один запрос можно передать до десяти референсов. Есть локальные правки по маске или нарисованным отметкам; разработчики отдельно выделяют сохранение внешности людей и деталей товаров при редактировании. Они также заявляют улучшения текстур, надписей и портретного света. Поддерживается нативная генерация в 2K и привычные пропорции: от квадрата до горизонтального 16:9 и вертикального 9:16. Описание возможностей и примеры — у команды Qwen.

Вот три примера со мной: портрет с карандашной штриховкой, иллюстрация в тёплых цветах и фотореалистичная сцена верхом на бегемоте. В них хорошо виден разброс стилизаций, от рисунка на бумаге до вымышленного кадра, похожего на фотографию.

Карандашная стилизация: портрет Сергея на фоне цветной штриховки. Создано в Qwen-Image-2.1.
Карандашная стилизация: портрет Сергея на фоне цветной штриховки. Создано в Qwen-Image-2.1.
Иллюстрация в тёплых тонах: портрет Сергея на фоне условного пейзажа. Создано в Qwen-Image-2.1.
Иллюстрация в тёплых тонах: портрет Сергея на фоне условного пейзажа. Создано в Qwen-Image-2.1.
Сергей верхом на бегемоте: вымышленная сцена в фотореалистичном стиле. Создано в Qwen-Image-2.1.
Сергей верхом на бегемоте: вымышленная сцена в фотореалистичном стиле. Создано в Qwen-Image-2.1.

Для локального запуска нужен ComfyUI с поддержкой модели: она есть в версии 0.37.0. Одного обновления недостаточно: нужно скачать совместимые веса и компоненты, затем открыть готовую схему генерации или редактирования.

При этом 7 млрд параметров относятся только к визуальному генератору. Кроме него используются энкодер Qwen3-VL 8B и VAE, поэтому размер одного файла весов нельзя принимать за требования всего запуска к памяти. Для видеокарт с ограниченной памятью предусмотрена выгрузка компонентов в оперативную память.

У весов Qwen Research License: исследовательское и оценочное использование разрешено, для коммерческого требуется отдельная лицензия. Это нужно учитывать, если планируете внедрять модель в рабочие проекты.

Следующий шаг

GPT Image — гайд по промптингу для генерации и редактирования изображений — для сравнения подходов к постановке задач другой модели изображений.

Связанные материалы

Статья: Как я сделал паспорт персонажа и проверил сходство на ИИ-картинках

Блог: Nano Banana 2: скорость Flash + качество Pro — в одном генераторе

База знаний: Qwen 3.8 (Alibaba) — актуальная экосистема открытых моделей: мультимодальность, агенты, локальный запуск

Если хотите понять, подходит ли локальная генерация изображений под ваши задачи и оборудование, можно разобрать конкретный сценарий.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov