Qwen Image — модель для генерации и редактирования изображений от команды Qwen компании Alibaba. Первая версия с открытыми весами объединяет создание изображений, отрисовку текста и редактирование по инструкциям. Особенно хорошо модель работает с китайской и английской типографикой.
В Phygital+ блок Qwen Image может создавать изображения по текстовому промпту или использовать до трёх исходных изображений как примеры. Они помогают задать персонажа, продукт, стиль, композицию или окружение. В блоке также доступны LoRA, несколько соотношений сторон, параметры seed для воспроизводимости результата и guidance для настройки точности следования промпту, а также готовые положения камеры.
В этом руководстве рассматривается версия Qwen Image, доступная в Phygital+. Сейчас уже существуют более новые семейства Qwen Image 2.0 и 3.0, поэтому их возможности описаны отдельно и не объединены в общий список.
Сравнение версий Qwen Image
| Версия | Главное преимущество | Для каких задач подходит |
|---|---|---|
| Qwen Image (2025) | Генерация изображений моделью 20B с открытыми весами, многоязычный текст и редактирование | Генерация в Phygital+, редактирование по примерам, LoRA и сценарии с управлением камерой |
| Qwen Image 2.0 | Генерация и редактирование в единой, более новой и компактной архитектуре | Сервисы, где эта версия доступна отдельно |
| Qwen Image 3.0 | Сложные композиции, мелкий текст, рассуждение, 1–3 примера и разрешение до 2048×2048 | Новые сценарии с Qwen Image API в Alibaba Cloud |
| Qwen Image 3.0 Pro | Более точная композиция, типографика и фотографические детали | Сложные дизайнерские задачи, когда доступна версия Pro |
Возможности Qwen Image
Генерация изображений по тексту
Модель понимает подробные описания объекта, композиции, стиля, освещения и типографики. Она подходит для создания плакатов, иллюстраций, концептов продуктов, изображений для журналов и медиа, а также визуальных материалов со строгой структурой.
Редактирование по инструкции
Подключите готовое изображение и опишите нужные изменения. Хороший промпт для редактирования точно указывает область, новое содержимое и элементы, которые должны остаться нетронутыми.
Композиция из нескольких изображений
До трёх исходных изображений могут задавать разные части результата. Одно — человека, второе — продукт, третье — место или стиль. В промпте важно чётко обозначить роль каждого изображения.
Многоязычный текст
Исходная модель рассчитана на отрисовку сложного текста, прежде всего на китайском и английском языках. Другие системы письма тоже могут работать, но в актуальной официальной документации по редактированию гарантирована поддержка только упрощённого китайского и английского. Поэтому любой локализованный результат нужно внимательно вычитывать.
Управление камерой и LoRA
В блоке Phygital+ доступны настройки угла и расстояния камеры, а также обученные и готовые LoRA. С их помощью можно менять композицию и визуальный стиль, не переписывая весь промпт.
Как работать с несколькими примерами
Сам по себе порядок изображений не задаёт универсальных правил. Опишите роль каждого из них в промпте:
- Изображение 1: сохранить лицо и причёску человека.
- Изображение 2: использовать куртку и аксессуары.
- Изображение 3: поместить персонажа в этот интерьер и согласовать с ним освещение.
Если редактирование не удаётся, уберите примеры, которые по-разному описывают один и тот же элемент. Модели проще согласовать небольшой набор совместимых исходных материалов.
Генерация и редактирование
Без начального изображения блок выполняет генерацию по промпту. При подключении примеров задача превращается в редактирование или сборку композиции. В режиме редактирования описывайте преобразование и правила сохранения деталей, вместо того чтобы повторять всё видимое содержимое.
Как создавать текст на изображениях
- Заключите точный текст в кавычки.
- Укажите язык текста отдельно от языка промпта.
- Опишите положение, размер и иерархию текста.
- Для первой генерации оставьте только основной заголовок и одну дополнительную строку.
- Попросите модель не добавлять другие слова.
- Проверьте готовое изображение в полном размере.
Qwen Image умеет создавать плакаты и композиции с более длинным текстом, чем многие диффузионные модели. Однако мелкий шрифт, сочетание разных систем письма, необычные имена и плотные абзацы всё равно требуют ручной проверки.
Как составлять промпты для Qwen Image
Составляйте промпт как техническое задание: укажите тип результата, объект, композицию, точный текст, стиль, освещение, роли исходных изображений и требования к сохранению деталей.
| Составляющая | Что описать | Пример |
|---|---|---|
| Результат | Плакат, изображение продукта, редактирование, иллюстрация | Вертикальная реклама косметики для ухода за кожей |
| Объект | Главный человек или предмет | Флакон с янтарной сывороткой на светлом камне |
| Композиция | Расположение, кадрирование и свободное пространство | Флакон по центру, текст в верхней левой трети |
| Текст | Точная формулировка и язык | «RESET YOUR GLOW» на английском языке |
| Стиль | Вид изображения, палитра, фактура и освещение | Тёплая журнальная фотография, мягкий дневной свет |
| Примеры | Роль каждого исходного изображения | Изображение 1 — продукт, изображение 2 — освещение |
| Ограничения | Детали, которые должны остаться неизменными | Сохранить крышку, этикетку, цвет стекла и пропорции |
Примеры промптов для Qwen Image
Двуязычный плакат
Create a vertical technology poster with a translucent blue sphere in a dark gallery. Headline in English: “NEW SIGNALS”. Supporting line in Simplified Chinese: “未来视觉实验”. Large white geometric typography, clean hierarchy, no extra words.
Реклама косметики
Create a premium skincare advertisement featuring the amber bottle from Image 1 on pale limestone. Use the warm window light from Image 2. Include “RESET YOUR GLOW” in refined black serif type. Preserve bottle shape, label, cap, and liquid color.
Композиция с продуктом
Use the headphones from Image 1, the model from Image 2, and the concrete studio from Image 3. Create a horizontal campaign image with the model wearing the exact headphones. Match reflections and shadows. Preserve face, product geometry, and logo.
Редактирование упаковки
Edit Image 1. Replace only the front label with a matte cream label reading “NORTH COAST” and “SEA SALT”. Keep the bottle, cap, glass, lighting, reflections, background, and camera angle unchanged.
Одежда персонажа
Preserve the face and hairstyle from Image 1. Dress the character in the red coat from Image 2 and place them in the snowy street from Image 3. Full-body editorial photograph, natural winter light, consistent anatomy.
Инфографика
Create a clean vertical infographic titled “A DAY OF ENERGY”. Show four labeled sections: “BREAKFAST”, “WORK”, “TRAINING”, and “REST”. Use simple icons, dark green text, cream background, clear reading order, no extra labels.
Меню ресторана
Design a one-page menu titled “AUTUMN TABLE”. Include three headings: “STARTERS”, “MAINS”, and “DESSERTS”. Warm white paper, deep burgundy serif typography, small line illustrations, generous spacing, readable text.
Другой ракурс камеры
Create a three-quarter low-angle product photograph of the same silver sneaker from Image 1. Preserve all materials, stitching, sole shape, and logo. Dark studio, narrow blue rim light, subtle floor reflection.
Новый дизайн интерьера
Edit the living room in Image 1. Replace the sofa with the green modular sofa from Image 2 and apply the warm wood palette from Image 3. Keep the architecture, windows, camera position, and daylight unchanged.
Обложка книги
Create a science-fiction book cover showing a small observatory under a huge pale moon. Title: “THE LAST TRANSMISSION”. Author: “ELI VOSS”. Minimal blue and ivory palette, sharp serif type, no additional text.
Плакат с едой
Create a square food poster featuring a bowl of spicy noodles photographed from above. Add “MIDNIGHT NOODLES” in bold yellow type and “OPEN UNTIL 2 AM” below. Red table, strong flash, energetic editorial layout.
Серия иллюстраций
Using the visual style from Images 1 and 2, illustrate a cyclist crossing a bridge at dawn. Preserve the flat shapes, grain, limited coral-and-navy palette, and simplified perspective. Leave clean space for a headline.
Замена фона
Edit Image 1. Keep the person, pose, clothing, hair, and foreground shadows. Replace only the background with a modern train platform at blue hour. Match the new light direction and depth of field.
Концепция логотипа
Create a clean wordmark for “FIELDNOTE”, a travel-journal brand. Rounded lowercase lettering with one simple compass detail. Black on white, flat vector-style presentation, no mockup, no slogan, no extra symbols.
Обложка карусели
Create a square social carousel cover titled “5 WAYS TO FIX A WEAK BRIEF”. Large black sans serif headline, one oversized red number 5, white background, editorial grid, strong mobile readability, no additional copy.
Как выстроить сценарий с Qwen Image в Phygital+
Qwen Image можно встроить в более крупный процесс создания дизайна. Текстовая модель подготовит структуру задания и точные формулировки. Блоки генерации изображений создадут персонажа, продукт или окружение. Qwen объединит или отредактирует исходные материалы, а отдельные ветки позволят проверить разные настройки камеры, композиции, LoRA и guidance. Утверждённый результат можно передать дальше для повышения разрешения или создания видео.
- Определите итоговый материал, текст и правила сохранения деталей.
- Создайте или соберите до трёх примеров с разными ролями.
- Создайте или отредактируйте изображение в Qwen Image.
- Проверяйте ракурсы, композиции и стили LoRA в отдельных ветках, меняя по одной переменной за раз.
- Проверьте текст, внешность персонажа, детали продукта и тени.
- Повысьте разрешение выбранного изображения или анимируйте его.
На холсте сохраняются связи между всеми исходными материалами и вариантами. Благодаря этому правки клиента проще повторить.
Стоимость Qwen Image в Phygital+
Qwen Image расходует кредиты Phygital. Актуальная стоимость отображается внутри блока до запуска генерации и может зависеть от выбранных настроек и количества изображений. Средства на балансе подписки также можно использовать в связанных блоках для работы с текстом, изображениями, видео и другими инструментами.
Частые проблемы с Qwen Image
Модель меняет слишком много деталей
Точно назовите область изменения и перечислите все важные элементы, которые должны остаться прежними.
Примеры противоречат друг другу
Назначьте каждому изображению одну роль и уберите дубли, в которых по-разному выглядят человек, форма продукта или стиль.
В тексте есть ошибки
Сократите текст, заключите его в кавычки, попросите не добавлять другие слова и проверьте результат в полном разрешении.
Элементы композиции выглядят вклеенными
Попросите модель согласовать перспективу, направление света, тени, цветовую температуру и глубину резкости.
Персонаж теряет узнаваемость
Используйте самое чёткое изображение лица как основной пример и не меняйте одновременно лицо, волосы, позу, ракурс и стиль.
Настройки камеры искажают объект
Меняйте угол небольшими шагами и явно указывайте, какие особенности человека или продукта должны остаться неизменными.
Текущие ограничения
Модель всё ещё может ошибаться при работе с плотным текстом, сочетанием языков, мелкими буквами, точными логотипами, сложными положениями рук и резкой сменой ракурса. LoRA и исходные изображения также могут направлять результат в разные стороны. Считайте созданные товарные знаки, текст на упаковке и утверждения, требующие юридического согласования, черновиками до проверки.
Вопросы и ответы
Что такое Qwen Image?
Qwen Image — семейство моделей Alibaba для генерации и редактирования изображений. Исходная версия 2025 года — модель 20B с открытыми весами, предназначенная прежде всего для отрисовки текста и редактирования по инструкциям.
Какая версия Qwen Image доступна в Phygital+?
На текущей странице модели описана исходная версия Qwen Image. Ориентируйтесь на настройки внутри блока: функции Qwen Image 3.0 API могут в нём отсутствовать.
Сколько исходных изображений можно использовать?
Блок Qwen Image в Phygital+ поддерживает до трёх исходных изображений.
Можно ли редактировать готовое изображение в Qwen Image?
Да. Подключите одно или несколько изображений и опишите нужное изменение, а также детали, которые должны остаться неизменными.
Хорошо ли Qwen Image работает с текстом?
Да, особенно с текстом на китайском и английском языках. Другие системы письма тоже могут работать, но каждый готовый материал необходимо вычитывать.
Можно ли использовать LoRA?
Да. Блок Phygital+ поддерживает обученные LoRA и готовые модификаторы с регулируемой силой воздействия.
Какие разрешения доступны?
На текущей странице модели в Phygital+ указаны размеры сторон от 512 до 1664 пикселей и несколько готовых соотношений сторон.
Чем Qwen Image отличается от Qwen Image 3.0?
Qwen Image 3.0 — более новое облачное семейство с генерацией и редактированием, настройками рассуждения, поддержкой до трёх примеров и разрешением до 2048×2048. Исходная модель — отдельная версия с открытыми весами.
Сколько стоит Qwen Image в Phygital+?
Модель расходует кредиты Phygital, а актуальная стоимость отображается внутри блока до запуска генерации.
Зачем использовать Qwen Image в Phygital+?
В Phygital+ можно на одном холсте подготовить задание и исходные изображения, выполнить генерацию и редактирование в Qwen, сравнить варианты с LoRA, повысить разрешение результата и создать видео.