Место #1 Локальная генерация изображений — Пиксели на вашем компьютере
Alibaba (Qwen Team)

Qwen-Image-2.1

Qwen-Image-2.1 — небольшая и толковая модель для изображений, которую можно скачать и запустить у себя. Её генератор изображений на 7 миллиардов параметров создаёт обычные и прозрачные изображения в 2K, редактирует фотографии и объединяет до десяти референсных изображений в одну сцену. Подвох юридический, а не технический: в отличие от прежних моделей Qwen для изображений, её лицензия не разрешает коммерческое использование.

Обновлено 27 сентября 2026 7B DiTLocal ImageNative RGBA
Лучше всего для

Qwen-Image-2.1 — небольшая и толковая модель для изображений, которую можно скачать и запустить у себя. Её генератор изображений на 7 миллиардов параметров создаёт обычные и прозрачные изображения в 2K, редактирует фотографии и объединяет до десяти референсных изображений в одну сцену. Подвох юридический, а не технический: в отличие от прежних моделей Qwen для изображений, её лицензия не разрешает коммерческое использование.

Почему он побеждает

Компактный визуальный генератор на 7 млрд параметров (32 однопоточных слоя DiT) — намного меньше 20-миллиардных моделей прежнего семейства Qwen-Image. Нативно создаёт прозрачные изображения (RGBA), редактирует прозрачные слои и вырезает объекты из фотографий. Принимает до 10 референсных изображений и локальные правки, отмеченные кругом, каракулями или маской. Нативный вывод 2048×2048, а также широкие и вертикальные форматы. Поддержка в ComfyUI и Diffusers с первого дня.

Обратите внимание

Модель выпущена под Qwen Research License, а не под Apache 2.0, как прежние модели Qwen для изображений. Личное и исследовательское использование разрешено; чтобы продавать изображения или строить на ней платный продукт, нужно отдельное соглашение с Alibaba. Поэтому дополнения от сообщества (LoRA, дообученные версии) будут появляться медленнее.

01

Что это на самом деле

У тех, кто запускает ИИ на собственном компьютере, с моделями для изображений была одна досадная история: каждая новая была лучше — и каждая новая была больше. Более качественный текст и более чёткие детали обычно означали, что нужна видеокарта подороже.

Qwen-Image-2.1, выпущенная Alibaba 20 сентября 2026 года, ломает эту закономерность. Она меньше предыдущих моделей Qwen для изображений и умеет больше.

Маленькая и неожиданно способная

Та часть модели, которая собственно рисует изображение, содержит 7 миллиардов параметров. Это заметно меньше, чем генератор на 20 миллиардов параметров, на котором строились прежние модели Qwen-Image. По словам Alibaba, этого удалось добиться упрощённой архитектурой — 32 «однопоточных» слоя обрабатывают текст и изображение вместе — и приёмами, которые позволяют не делать одну и ту же работу дважды.

Для вас это значит, что модель легче и дешевле в запуске. И умеет она больше:

  • Прозрачные изображения. Попросите стикер, игровой спрайт или вырезанное фото товара — и она может создать его с по-настоящему прозрачным фоном. Большинство моделей рисуют фон и оставляют его удаление вам, обычно с размытым ореолом вокруг волос или стекла. Кроме того, Qwen-Image-2.1 умеет редактировать прозрачные слои и вырезать объект из готовой фотографии.
  • До десяти референсов. Дайте ей фото человека, куртку из интернет-магазина и снимок комнаты — и она может поместить этого человека в этой куртке в эту комнату. Среди примеров самой Alibaba — групповое фото, собранное из шести отдельных портретов.
  • Показать, а не описывать. Чтобы изменить часть изображения, её можно обвести, почеркать поверх или дать маску, а не пытаться объяснить словами, где находится «та штука слева».
  • Вывод в 2K. Модель нативно генерирует в 2048×2048, а также в широком, вертикальном и других форматах.

С первого дня она работала в ComfyUI и Hugging Face Diffusers — двух самых популярных способах запускать модели для изображений локально.

Подвох: лицензия изменилась

Вот где хорошие новости становятся сложнее.

Прежние модели Qwen для изображений выходили под Apache 2.0 — одной из самых щедрых лицензий в мире программного обеспечения. Их можно было скачать, доработать, встроить в продукт и продавать то, что они создают, ни у кого не спрашивая разрешения.

Qwen-Image-2.1 выпущена вместо этого под Qwen Research License.

Эта лицензия позволяет экспериментировать, заниматься исследованиями и создавать искусство для себя. Но как только вы строите на ней платное приложение, продаёте сгенерированные изображения клиентам или используете её внутри коммерческого продукта, вам нужно отдельное соглашение с Alibaba.

Это не просто юридический мелкий шрифт. Инструменты для изображений с открытым кодом процветают потому, что люди свободно делятся дополнениями: стилями, персонажами и дообученными версиями. Лицензия только для исследований означает, что в эту экосистему будут вкладываться меньше компаний, поэтому расти она, скорее всего, будет медленнее, чем при лицензии Apache.

Кому подойдёт

  • Любителям, студентам, исследователям и художникам, которые создают личные работы: это одна из самых способных моделей для изображений, какие можно запустить дома. Компактная, создаёт настоящие прозрачные изображения и справляется с десятью референсами одновременно. Попробуйте.
  • Тем, кто строит бизнес: сначала прочитайте лицензию. Для коммерческой свободы без необходимости спрашивать разрешения более надёжной почвой остаются FLUX.2 Klein и другие модели со свободными лицензиями.

Qwen-Image-2.1 показывает, насколько хорошими стали небольшие локальные модели для изображений. И она же показывает, что «открытая» и «свободная для коммерческого использования» — не всегда одно и то же.

02

Сильные стороны и честные ограничения

Ключевые преимущества

  • Достаточно мала для домашнего компьютера: у генератора изображений 7 миллиардов параметров — гораздо меньше, чем у 20-миллиардных моделей прежних версий Qwen-Image, а Alibaba добавляет приёмы вроде повторного использования вычислений внимания, чтобы запуск обходился дёшево. Меньше памяти — значит, больше людей смогут запустить её на своей видеокарте.
  • Настоящая прозрачность: большинство локальных моделей рисуют объект на фоне и оставляют вырезку вам, из-за чего вокруг волос или стекла обычно остаётся размытый ореол. Qwen-Image-2.1 может сразу создавать прозрачные изображения (RGBA), редактировать прозрачные слои и вырезать объект из фотографии.
  • До десяти референсов: дайте ей фото человека, куртку из интернет-магазина и комнату — и она может объединить их в одну сцену, сохранив узнаваемость лиц и товаров. Среди примеров самой Alibaba — групповое фото, собранное из шести отдельных портретов.
  • Покажите, что изменить: локальные правки можно отметить кругом, нарисованными каракулями или отдельной маской — описывать место словами не нужно.
  • Чёткость в 2K: нативный вывод 2048×2048, плюс широкие и вертикальные форматы, с улучшенной отрисовкой текста, портретного освещения и мелких деталей.

Честные ограничения

  • Не для коммерческого использования: Qwen-Image-2.1 использует Qwen Research License. Прежние модели Qwen для изображений выходили под Apache 2.0, которая разрешала коммерческое использование всем. Теперь, если вы берёте деньги за изображения или строите на этих весах платный продукт, вам нужна отдельная лицензия от Alibaba.
  • Пока сообщество меньше: новая архитектура плюс ограничительная лицензия означают меньше созданных сообществом стилей, персонажей и дополнений, чем у FLUX.2 Klein или более старых моделей под лицензией Apache.
  • Совсем новая: модель вышла 20 сентября 2026 года. Независимых сравнений качества, скорости и потребления памяти на домашнем железе пока мало, так что проверьте её на своих промптах.
  • Особые формулировки для прозрачности: прозрачный вывод лучше всего работает с формулировкой в промпте, которую рекомендует Alibaba (например, с прямым указанием, что у изображения есть альфа-канал).
03

Результаты тестов

Визуальный генератор — 7 млрд параметров

32 однопоточных слоя DiT с вниманием смешанной гранулярности и повторным использованием KV-кэша префикса, по данным Alibaba. Прежние модели Qwen-Image строились вокруг генератора на 20 млрд параметров.

Нативная прозрачность (RGBA)

Создаёт прозрачные изображения по тексту, редактирует прозрачные слои и вырезает объекты из фотографий — всё в одной модели.

До 10 референсных изображений

Объединяет несколько референсов, сохраняя узнаваемость людей и товаров; локальные правки — кругами, нарисованными пометками или масками.

Вывод — нативно 2048×2048

А также 16:9 (2752×1536), 9:16, 4:3, 3:2 и другие соотношения сторон, согласно карточке модели от Alibaba.

Лицензия — Qwen Research License

Исследования и личное использование разрешены; коммерческое использование требует отдельного соглашения. Прежние модели Qwen для изображений выходили под Apache 2.0.

04

Вердикт

Qwen-Image-2.1 — технически впечатляющая локальная модель для изображений с подвохом в лицензии. Для любителей, студентов, исследователей и художников, которые создают личные работы в ComfyUI, это одна из самых способных моделей, какие можно запустить дома: компактная, с настоящей прозрачностью и десятью референсами одновременно. Для тех, кто строит на этих изображениях бизнес, всё иначе. Лицензия запрещает коммерческое использование без разрешения Alibaba, поэтому FLUX.2 Klein и другие модели со свободными лицензиями остаются более надёжной основой.

05

Часто задаваемые вопросы