Материал подготовлен автоматически по первоисточникам: ссылки на них — в конце статьи.
Alibaba открыла веса Qwen-Image-2.1 — модели на 7 млрд параметров, которая генерирует изображения и редактирует готовые. Она может убрать отдельные этапы графического конвейера там, где продукту нужны прозрачные слои, локальные правки и сохранение внешнего вида объектов по нескольким образцам.
Модель создаёт и редактирует слои RGBA с прозрачностью, включая текст внутри них. Это подходит для карточек товаров, рекламных макетов и инфографики: фон, объект и надпись можно получить в форме, пригодной для дальнейшей сборки, без отдельного удаления фона.
Qwen-Image-2.1 принимает до десяти эталонных изображений и должна сохранять сходство портретов и товаров при локальных изменениях. По трём видам персонажа модель также может собрать раскадровку. Другие заявленные сценарии — панорамы и виртуальная примерка.
Перед заменой текущей связки стоит проверить на собственных материалах края прозрачных объектов, точность текста, сохранение товара или персонажа после правок и скорость при нескольких входных изображениях. Пост называет веса открытыми, но не приводит условия лицензии, поэтому по нему нельзя подтвердить допустимость коммерческого использования. Для запуска уже заявлена поддержка vLLM и ComfyUI.
Источники
Похоже на вашу задачу?
Расскажите, что собираете. За полчаса разложим на этапы и назовём сроки — это бесплатно и ни к чему не обязывает.



