Что это за модель
Alibaba показала Qwen-Image-3.0 21 июля 2026 года. Первая версия модели была сосредоточена на «точности», вторая добавляла к этому «разнообразие, полноту, красоту и достоверность», для третьей команда Qwen выбрала слово «реальность»: модель должна закрывать практические задачи вроде вёрстки газетных полос, раскадровок и экзаменационных бланков, а не только генерировать красивые картинки.
Главное техническое изменение касается длины промта. Модель принимает до 4500 токенов текста на входе, примерно в 4,5 раза больше, чем во второй версии. Такой объём позволяет описывать сцену подробно, почти как техническое задание дизайнеру: что где расположено, какой текст в каком блоке, какой стиль и раскладка. Это дает возможность получать сложный многоэлементный макет за один проход, без сборки из нескольких генераций.
В отличие от первых двух версий, которые вышли с открытыми весами и техническим отчетом, Qwen-Image-3.0 выпущена без бенчмарков, без весов модели, без технического отчета и без карточки модели. Все заявления о качестве пока опираются на примеры изображений, которые выбрала для публикации сама Alibaba, а не на независимо проверяемые цифры.
Что умеет модель
Длинные и детальные промпты. На Syntasy расширенное окно инструкций Qwen-Image-3 позволяет за одну генерацию собирать многопанельные композиции: постеры, страницы с диаграммами, раскадровки, обучающие схемы с подписями. Модель нативно поддерживает рендер текста на 12 языках и с использованием более чем 20 шрифтов, что закрывает частую проблему ИИ-генерации — нечитаемые символы и разъезжающуюся раскладку — прямо в интерфейсе платформы.
Мелкий и плотный текст. В демонстрационных материалах Alibaba есть кадр с вложенными друг в друга интерфейсами, например чат-приложение поверх окна редактора кода, где текст остается читаемым при размере около 10 пикселей. Отдельно показан пример с девятью независимыми инфографиками в сетке 3×3, у каждой свой текст, формулы и иллюстрации.
Мировые знания. В релизе заявлена способность модели опираться на актуальные данные при генерации, например собирать карту погоды для конкретного города и даты или воспроизводить вид типового веб-интерфейса. Эта часть возможностей описана менее подробно, чем текст и вёрстка, и пока меньше всего проверена сторонними тестами.
Редактирование по референсу. Доступен режим правки готового изображения с сохранением деталей исходника: можно точечно менять цвет, надпись или элемент композиции, не перегенерируя картинку целиком.
Доступ на момент релиза был закрытым: только по приглашению, без публичного API, через хостинговый интерфейс Qwen Chat. На Syntasy модель уже подключена и доступна без ограничений по приглашениям.
Как сгенерировать изображение на Syntasy
- Открыть вкладку Дизайн в верхнем меню
- Выбрать модель Qwen-Image-3 в панели настроек
- Описать композицию в поле промта: что должно быть на изображении
- При необходимости прикрепить референс для редактирования через кнопку загрузки
- Отправить запрос и дождаться генерации
Чем подробнее описана структура макета, тем точнее модель размещает элементы. Благодаря увеличенному окну промта не нужно сокращать техническое задание: можно писать его почти так же подробно, как бриф для дизайнера.
Что ещё доступно после генерации
Под каждым результатом есть панель действий и пресеты для быстрой обработки без написания промта:
- Удаление фона
- Отреставрировать фото
- Улучшить качество фото
- Увеличить разрешение фото
- Убрать шум и размытие
- Раскрасить Ч/Б фото
- Перерисовать в стиле
- Сделать как в Paint
Готовое изображение можно отредактировать текстовой командой в чате, превратить в видео одним нажатием, сохранить в закладки или отправить на конкурс, а также скачать в исходном разрешении.
Чем Qwen-Image-3 отличается от других моделей
Qwen-Image-3 и Qwen-Image-2.0. Разница в первую очередь в объёме промта и сложности макета, который модель генерирует за раз: у 2.0 лимит был около 1000 токенов, у 3.0 - 4500. Для короткого промта и одиночной картинки без обилия текста разница будет не так заметна, но для многопанельных композиций и плотных инфографик 3.0 ощутимо выигрывает.

Qwen-Image-3 и Nano Banana Pro / Nano Banana 2. Nano Banana поддерживает более 25 языков против 12 у Qwen и удобнее в итеративной правке: можно постепенно донастраивать сцену диалогом, не теряя консистентность персонажа между кадрами. На самых сложных случаях, плотных сетках с обилием мелкого текста и полностраничных макетах с десятком текстовых блоков, Qwen-Image-3 показывает себя увереннее. Если результат это баннер с заголовком и коротким призывом к действию, разница между моделями не критична. Если это полноценная страница инфографики, выбор чаще падает на Qwen.

Qwen-Image-3 и GPT-Image-2. Прямых опубликованных сравнений по цифрам пока нет: обе модели закрытые в части бенчмарков конкретно для этой версии. На практике выбор между ними определяется тем, что важнее для задачи: глубина работы с длинным детальным техническим заданием (сильная сторона Qwen) или зрелость экосистемы и предсказуемость API (сильная сторона OpenAI).

Как писать промты для Qwen-Image-3
Описывайте макет как техническое задание. Расширенное окно промпта позволяет не экономить на деталях: указывайте количество блоков, содержимое каждого из них, порядок чтения, стиль и палитру, как в брифе для дизайнера.
Прописывайте текст дословно. Если в макете должна быть конкретная надпись, заголовок или подпись к диаграмме, указывайте её точный текст в кавычках, а не пересказывайте смысл своими словами.
Задавайте структуру сетки явно. Для многопанельных композиций (постеры, инфографика, сторибоард) полезно прямо описать сетку: количество панелей и содержимое каждой, а не просто перечислить темы одним списком.
Используйте референс вместо словесного описания. Для правок и сохранения стиля точнее сработает загруженное изображение, чем подробное текстовое описание внешности или композиции.
Когда использовать
Qwen-Image-3 подходит для постеров и макетов с точным заранее заданным текстом, инфографики с диаграммами и формулами, многопанельных композиций и раскадровок, карточек товара с таблицами и подписями, обучающих материалов и схем с подписанными элементами. Для одиночной иллюстрации без текста, где важнее художественность и лёгкая правка диалогом, стоит присмотреться к другим моделям каталога. Разница в пользу Qwen-Image-3 заметнее всего именно на плотных, текстонасыщенных макетах.



