← Блог Новости

Qwen-Image-2.1: картинки с прозрачным фоном

· · 6 минут чтения
Qwen-Image-2.1: объект над прозрачной шахматной сеткой, слои картинки расходятся

Коротко. 20 сентября 2026 года команда Qwen выложила новую рисующую модель Qwen-Image-2.1. Главная новость — прозрачность считает сама модель: картинка выходит сразу с прозрачным фоном, без обтравки вторым инструментом. Родное разрешение подняли до 2048×2048, генерацию и редактирование свели в одну модель. Подвох тоже есть, и крупный: веса отдали под исследовательской лицензией, коммерческое использование без отдельного договора запрещено.

Что случилось

Qwen — линейка моделей Alibaba, та самая, чьи текстовые версии давно разошлись по открытым каталогам. Рисующая ветка у неё отдельная, и до сих пор она была разбита на части: одна модель рисовала по описанию, другая правила присланное изображение, третья отвечала за послойный вывод с прозрачностью. Версия 2.1 собирает всё это в один файл весом около 7 миллиардов параметров и выкладывает его на Hugging Face и ModelScope. Текстовую часть запроса разбирает встроенный кодировщик на базе Qwen3-VL — тот же движок, что понимает картинки, поэтому модель неплохо считывает длинные описания.

Что она умеет

Три вещи, ради которых её стоит заметить.

  1. Прозрачный фон из коробки. Модель выдаёт RGBA — формат, где у каждой точки есть степень прозрачности. Это не «фон убрали после генерации», а «фона никогда и не было». На волосах, дыме, стекле и тонких ветках разница видна сразу: привычная обтравка на таких краях мажет, а здесь прозрачность считается вместе с самим изображением.
  2. 2048×2048 без апскейла. Родное разрешение выросло, есть и вытянутые пропорции — вплоть до 2752×1536. Картинку не надо потом растягивать увеличивающей моделью, что обычно и портит мелкие детали.
  3. Редактирование по маске и по референсам. Нужный кусок можно обвести кружком, закрасить или подать отдельной маской — и переписать словами только его. За один раз модель принимает до десяти опорных изображений: так удерживают один и тот же персонаж или один стиль в серии картинок.

Отдельно хвалят текст на картинке: тестировщики называют качество надписей лучшим среди открытых моделей — и для латиницы, и для иероглифов. На собственном замере Qwen модель набирает 60,28 балла и стоит седьмой из 29 сравниваемых. Цифра из рук разработчика, независимых проверок пока нет, так что относиться к ней стоит как к заявке, а не к факту. Скачать веса можно со страницы команды на Hugging Face.

Главный подвох — лицензия

И вот здесь новость становится неприятной. Прошлые открытые модели Qwen выходили под Apache 2.0 — то есть делай что хочешь, включая продажу. Qwen-Image-2.1 выложена под исследовательской лицензией: использование разрешено только для исследований и оценки. Никаких карточек товара, обложек для клиента, стикерпаков на продажу и генерации внутри своего сервиса — для этого нужно отдельное соглашение, а публичных условий и цены на него нет, только почта для запроса.

Практический вывод простой: «открытые веса» в этом случае означают «можно посмотреть», а не «можно работать». Дизайнеру и владельцу магазина это не подходит, исследователю и энтузиасту с домашней видеокартой — вполне.

Нужна картинка сегодня, а не когда откроют лицензию?

Девять рисующих моделей в одном чате: запрос по-русски, правка присланного фото, оплата рублями.

Открыть Умку →

Как попробовать из России

Честно: прямого способа «зайти и нажать кнопку» у этой модели пока нет. Она существует как набор весов, который надо скачать и запустить у себя — это видеокарта, окружение и несколько часов возни. В Умке Qwen-Image-2.1 на момент выхода статьи нет, и обещать её мы не станем: модель без коммерческой лицензии в платный сервис не ставят.

Если задача не «потрогать новинку», а получить картинку, то в Умке рисуют девять других моделей — они принимают описание по-русски, правят присланное фото и тоже умеют писать текст прямо на изображении. Что именно выбирать под задачу, разобрано в гайде «Нейросеть для генерации изображений», а если нужен как раз прозрачный фон под логотип — смотрите «Как создать логотип нейросетью». Текстовые модели Qwen в Умке есть и работают из России без VPN: про свежую флагманскую версию писали в разборе Qwen 3.8 Max.

Сколько это стоит в Умке

Мерки простые: картинка на обычной рисующей модели — 35 токенов, на сильной — 148, на бесплатной — около 23. Пакеты пополнения: 290 ₽ — 725 токенов, 690 ₽ — 1 811, 1 490 ₽ — 4 172, 3 900 ₽ — 11 700. То есть на минимальном пакете выходит около двадцати картинок на обычной модели или четырёх на сильной, а одна обычная генерация стоит примерно 14 ₽ (и около 12 ₽ на максимальном пакете, где токен дешевле). При регистрации дают 60 токенов в подарок — этого хватит на пару генераций, чтобы решить, нужно ли пополнять. Подписки нет, списание по факту, остаток не сгорает. Актуальные цифры — на странице тарифов.

Вывод

Технически Qwen-Image-2.1 — заметный шаг: родная прозрачность и правки по маске в одной модели закрывают ту часть работы, ради которой обычно открывают графический редактор. Юридически это пока витрина. Если Qwen откроет нормальную коммерческую лицензию, модель быстро разойдётся по сервисам; до тех пор новость интересна как направление, в котором двигаются рисующие нейросети, а не как рабочий инструмент.

300+ нейросетей в одном окне

Картинки, тексты, видео и музыка — из России, без VPN и зарубежных карт.

Открыть Умку →

Частые вопросы

Что нового в Qwen-Image-2.1?

Главное — прозрачный фон получается сразу, на выходе модели. Раньше прозрачность приходилось добывать отдельным шагом: вырезать объект по контуру или брать специальную версию модели. Плюс родное разрешение выросло до 2048×2048, а генерация и редактирование объединены в одну модель вместо двух разных.

Можно ли использовать Qwen-Image-2.1 в коммерческих целях?

По умолчанию нет. Веса выложены под исследовательской лицензией Qwen, которая разрешает использование только для исследований и оценки. Для коммерческого применения нужно отдельное соглашение с Qwen, публичного прайса на него нет. Это заметный шаг назад по сравнению с прошлыми открытыми моделями Qwen, которые шли под свободной лицензией Apache 2.0.

Есть ли Qwen-Image-2.1 в Умке?

На момент выхода статьи нет: модель опубликована как веса под исследовательской лицензией и ещё не работает как обычный платный сервис. В Умке доступны девять других рисующих моделей — они принимают запрос по-русски, правят присланное фото и умеют писать текст прямо на картинке.

Зачем вообще нужен прозрачный фон от нейросети?

Чтобы картинку можно было положить поверх чего угодно без белого прямоугольника вокруг. Это логотипы, иконки, стикеры, элементы для презентаций и карточек товара. Обычно фон убирают вторым инструментом, и на волосах, дыме или стекле край получается грязным — когда прозрачность считает сама модель, этой проблемы меньше.