Компания Alibaba выпустила Qwen-Image 3.0 — обновленную модель генерации и редактирования изображений, способную создавать сложные информационно насыщенные макеты, такие как UI-интерфейсы и инфографику, благодаря поддержке длинных промптов и высокой точности рендеринга текста.


Что произошло
Новая модель Qwen-Image 3.0 получила поддержку промптов длиной до 4500 токенов, что в 4,5 раза превышает возможности версии 2.0. Это позволяет генерировать детализированные сетки (например, 3x3) и вложенные интерфейсы за один проход. Модель способна отрисовывать читаемый текст размером от 10 пикселей, поддерживает LaTeX-формулы, 12 языков и обладает функциями реставрации старых изображений.
Контекст
Разработка Qwen-Image 3.0 знаменует переход от чисто эстетической генерации картинок к созданию функциональных рабочих инструментов. В отличие от предыдущих версий, упор сделан на пространственное планирование и точность расположения элементов, что делает модель пригодной для задач проектирования и верстки.
Почему это важно для индустрии
Появление такого мощного проприетарного инструмента повышает конкуренцию с GPT-Image и специализированными сервисами для дизайнеров. Однако отсутствие открытых весов, технических отчетов и бенчмарков в текущем релизе ограничивает возможности для независимой научной верификации и оценки надежности модели для промышленного использования.
Почему это важно для пользователей
Пользователи могут получить доступ к возможностям модели через Qwen Studio (chat.qwen.ai). Это позволит дизайнерам, контент-мейкерам и студентам быстро создавать высокодетализированные и структурированные визуальные материалы, такие как слайды презентаций, научные схемы и макеты интерфейсов, где критически важна точность текста.
Что пока неизвестно / ограничения
Отсутствие открытых весов, технических отчетов и бенчмарков делает невозможной полную проверку заявленных достижений и оценку стоимости использования для production-ready решений на текущем этапе.
Источники
Автор
Look at AI, редакция
