Qwen представила обновлённую линейку моделей для генерации и редактирования изображений

huggingface:Qwen · оригинал

Материал подготовлен автоматизированной редакционной системой. Факты можно сверить по указанному первоисточнику.

Организация Qwen обновила на платформе Hugging Face три модели семейства Qwen-Image-2.1, включая специализированные варианты для работы с текстом и изображениями. Обновления затрагивают как базовую модель генерации, так и инструменты переписывания промптов.

Ценность: Обновление расширяет функциональность экосистемы Qwen для задач компьютерного зрения, предлагая пользователям улучшенные пайплайны для создания и редактирования визуального контента.

Команда разработчиков из организации Qwen опубликовала на платформе Hugging Face обновлённые версии своих моделей, ориентированных на генерацию и редактирование изображений. В центре внимания находится семейство Qwen-Image-2.1, которое включает несколько специализированных компонентов, предназначенных для различных этапов работы с визуальным контентом. Обновление затронуло как базовую модель генерации, так и дополнительные инструменты, отвечающие за оптимизацию пользовательских запросов.

Одной из ключевых новинок стала модель Qwen/Qwen-Image-2.1-PE-I2I. Согласно метаданным на платформе, этот компонент специализируется на редактировании изображений (image-editing) и переписывании промптов (prompt-rewriting). Модель использует формат хранения safetensors и относится к семейству qwen3_5. На момент публикации количество загрузок составляло ноль, однако модель уже получила 20 отметок от пользователей. Лицензия указана как «other», а регион размещения — США.

Параллельно было обновлено и решение Qwen/Qwen-Image-2.1-PE-T2I. Эта модель также работает с форматом safetensors и включает теги prompt-rewriting и text-to-image. В отличие от предыдущего варианта, здесь явно указан пайплайн text-to-image. Статистика активности схожа: загрузок пока не зафиксировано, но количество отметок достигло 13. Как и в случае с I2I-версией, лицензия классифицирована как «other», а хостинг осуществляется в регионе США.

Наибольшую активность среди обновлённых моделей демонстрирует базовый вариант Qwen/Qwen-Image-2.1. Эта модель предназначена для генерации изображений по текстовому описанию (text-to-image) и поддерживает редактирование. В отличие от специализированных PE-моделей, здесь используется пайплайн diffusers:QwenImage21Pipeline, что указывает на интеграцию с популярной библиотекой Diffusers. Модель поддерживает работу с форматом RGBA и хранится в формате safetensors.

По данным платформы Hugging Face, базовая модель Qwen/Qwen-Image-2.1 уже набрала 183 загрузки и 496 отметок, что свидетельствует о её более широком распространении по сравнению с новыми специализированными компонентами. Все три модели объединены общим набором тегов, включающим qwen и указание на регион США. Лицензионные условия для всех перечисленных моделей остаются неизменными и обозначены как «other».

Обновление линейки Qwen-Image-2.1 демонстрирует продолжение работы команды над совершенствованием инструментов для работы с изображениями. Разделение функций на отдельные модели — генерация, редактирование и переписывание промптов — позволяет разработчикам выбирать наиболее подходящий инструмент под конкретную задачу. Использование стандартных форматов хранения и интеграция с экосистемой Diffusers упрощают внедрение этих моделей в существующие рабочие процессы.