Open Call
для AI video
art авторов

Руководство по Qwen Image: текст, редактирование и примеры

Qwen Image — модель для генерации и редактирования изображений от команды Qwen компании Alibaba. Первая версия с открытыми весами объединяет создание изображений, отрисовку текста и редактирование по инструкциям. Особенно хорошо модель работает с китайской и английской типографикой.

В Phygital+ блок Qwen Image может создавать изображения по текстовому промпту или использовать до трёх исходных изображений как примеры. Они помогают задать персонажа, продукт, стиль, композицию или окружение. В блоке также доступны LoRA, несколько соотношений сторон, параметры seed для воспроизводимости результата и guidance для настройки точности следования промпту, а также готовые положения камеры.

В этом руководстве рассматривается версия Qwen Image, доступная в Phygital+. Сейчас уже существуют более новые семейства Qwen Image 2.0 и 3.0, поэтому их возможности описаны отдельно и не объединены в общий список.

Сравнение версий Qwen Image

ВерсияГлавное преимуществоДля каких задач подходит
Qwen Image (2025)Генерация изображений моделью 20B с открытыми весами, многоязычный текст и редактированиеГенерация в Phygital+, редактирование по примерам, LoRA и сценарии с управлением камерой
Qwen Image 2.0Генерация и редактирование в единой, более новой и компактной архитектуреСервисы, где эта версия доступна отдельно
Qwen Image 3.0Сложные композиции, мелкий текст, рассуждение, 1–3 примера и разрешение до 2048×2048Новые сценарии с Qwen Image API в Alibaba Cloud
Qwen Image 3.0 ProБолее точная композиция, типографика и фотографические деталиСложные дизайнерские задачи, когда доступна версия Pro
Важно учитывать версию: ориентируйтесь на настройки активного блока. Функции из документации Qwen Image 3.0 могут отсутствовать в исходной версии Qwen Image.

Возможности Qwen Image

Генерация изображений по тексту

Модель понимает подробные описания объекта, композиции, стиля, освещения и типографики. Она подходит для создания плакатов, иллюстраций, концептов продуктов, изображений для журналов и медиа, а также визуальных материалов со строгой структурой.

Редактирование по инструкции

Подключите готовое изображение и опишите нужные изменения. Хороший промпт для редактирования точно указывает область, новое содержимое и элементы, которые должны остаться нетронутыми.

Композиция из нескольких изображений

До трёх исходных изображений могут задавать разные части результата. Одно — человека, второе — продукт, третье — место или стиль. В промпте важно чётко обозначить роль каждого изображения.

Многоязычный текст

Исходная модель рассчитана на отрисовку сложного текста, прежде всего на китайском и английском языках. Другие системы письма тоже могут работать, но в актуальной официальной документации по редактированию гарантирована поддержка только упрощённого китайского и английского. Поэтому любой локализованный результат нужно внимательно вычитывать.

Управление камерой и LoRA

В блоке Phygital+ доступны настройки угла и расстояния камеры, а также обученные и готовые LoRA. С их помощью можно менять композицию и визуальный стиль, не переписывая весь промпт.

Как работать с несколькими примерами

Сам по себе порядок изображений не задаёт универсальных правил. Опишите роль каждого из них в промпте:

  • Изображение 1: сохранить лицо и причёску человека.
  • Изображение 2: использовать куртку и аксессуары.
  • Изображение 3: поместить персонажа в этот интерьер и согласовать с ним освещение.

Если редактирование не удаётся, уберите примеры, которые по-разному описывают один и тот же элемент. Модели проще согласовать небольшой набор совместимых исходных материалов.

Генерация и редактирование

Без начального изображения блок выполняет генерацию по промпту. При подключении примеров задача превращается в редактирование или сборку композиции. В режиме редактирования описывайте преобразование и правила сохранения деталей, вместо того чтобы повторять всё видимое содержимое.

Формула редактирования: Use Image 1 for [identity or product]. Take [style or object] from Image 2. Place it in [environment from Image 3]. Change [target]. Preserve [specific details].

Как создавать текст на изображениях

  1. Заключите точный текст в кавычки.
  2. Укажите язык текста отдельно от языка промпта.
  3. Опишите положение, размер и иерархию текста.
  4. Для первой генерации оставьте только основной заголовок и одну дополнительную строку.
  5. Попросите модель не добавлять другие слова.
  6. Проверьте готовое изображение в полном размере.

Qwen Image умеет создавать плакаты и композиции с более длинным текстом, чем многие диффузионные модели. Однако мелкий шрифт, сочетание разных систем письма, необычные имена и плотные абзацы всё равно требуют ручной проверки.

Как составлять промпты для Qwen Image

Составляйте промпт как техническое задание: укажите тип результата, объект, композицию, точный текст, стиль, освещение, роли исходных изображений и требования к сохранению деталей.

СоставляющаяЧто описатьПример
РезультатПлакат, изображение продукта, редактирование, иллюстрацияВертикальная реклама косметики для ухода за кожей
ОбъектГлавный человек или предметФлакон с янтарной сывороткой на светлом камне
КомпозицияРасположение, кадрирование и свободное пространствоФлакон по центру, текст в верхней левой трети
ТекстТочная формулировка и язык«RESET YOUR GLOW» на английском языке
СтильВид изображения, палитра, фактура и освещениеТёплая журнальная фотография, мягкий дневной свет
ПримерыРоль каждого исходного изображенияИзображение 1 — продукт, изображение 2 — освещение
ОграниченияДетали, которые должны остаться неизменнымиСохранить крышку, этикетку, цвет стекла и пропорции
Формула промпта: Create a [type] featuring [subject] in [composition]. Include “[exact text]” in [typography]. Apply [style and lighting]. Use each reference for [role]. Preserve [fixed details].

Примеры промптов для Qwen Image

Двуязычный плакат

Create a vertical technology poster with a translucent blue sphere in a dark gallery. Headline in English: “NEW SIGNALS”. Supporting line in Simplified Chinese: “未来视觉实验”. Large white geometric typography, clean hierarchy, no extra words.

Реклама косметики

Create a premium skincare advertisement featuring the amber bottle from Image 1 on pale limestone. Use the warm window light from Image 2. Include “RESET YOUR GLOW” in refined black serif type. Preserve bottle shape, label, cap, and liquid color.

Композиция с продуктом

Use the headphones from Image 1, the model from Image 2, and the concrete studio from Image 3. Create a horizontal campaign image with the model wearing the exact headphones. Match reflections and shadows. Preserve face, product geometry, and logo.

Редактирование упаковки

Edit Image 1. Replace only the front label with a matte cream label reading “NORTH COAST” and “SEA SALT”. Keep the bottle, cap, glass, lighting, reflections, background, and camera angle unchanged.

Одежда персонажа

Preserve the face and hairstyle from Image 1. Dress the character in the red coat from Image 2 and place them in the snowy street from Image 3. Full-body editorial photograph, natural winter light, consistent anatomy.

Инфографика

Create a clean vertical infographic titled “A DAY OF ENERGY”. Show four labeled sections: “BREAKFAST”, “WORK”, “TRAINING”, and “REST”. Use simple icons, dark green text, cream background, clear reading order, no extra labels.

Меню ресторана

Design a one-page menu titled “AUTUMN TABLE”. Include three headings: “STARTERS”, “MAINS”, and “DESSERTS”. Warm white paper, deep burgundy serif typography, small line illustrations, generous spacing, readable text.

Другой ракурс камеры

Create a three-quarter low-angle product photograph of the same silver sneaker from Image 1. Preserve all materials, stitching, sole shape, and logo. Dark studio, narrow blue rim light, subtle floor reflection.

Новый дизайн интерьера

Edit the living room in Image 1. Replace the sofa with the green modular sofa from Image 2 and apply the warm wood palette from Image 3. Keep the architecture, windows, camera position, and daylight unchanged.

Обложка книги

Create a science-fiction book cover showing a small observatory under a huge pale moon. Title: “THE LAST TRANSMISSION”. Author: “ELI VOSS”. Minimal blue and ivory palette, sharp serif type, no additional text.

Плакат с едой

Create a square food poster featuring a bowl of spicy noodles photographed from above. Add “MIDNIGHT NOODLES” in bold yellow type and “OPEN UNTIL 2 AM” below. Red table, strong flash, energetic editorial layout.

Серия иллюстраций

Using the visual style from Images 1 and 2, illustrate a cyclist crossing a bridge at dawn. Preserve the flat shapes, grain, limited coral-and-navy palette, and simplified perspective. Leave clean space for a headline.

Замена фона

Edit Image 1. Keep the person, pose, clothing, hair, and foreground shadows. Replace only the background with a modern train platform at blue hour. Match the new light direction and depth of field.

Концепция логотипа

Create a clean wordmark for “FIELDNOTE”, a travel-journal brand. Rounded lowercase lettering with one simple compass detail. Black on white, flat vector-style presentation, no mockup, no slogan, no extra symbols.

Обложка карусели

Create a square social carousel cover titled “5 WAYS TO FIX A WEAK BRIEF”. Large black sans serif headline, one oversized red number 5, white background, editorial grid, strong mobile readability, no additional copy.

Как выстроить сценарий с Qwen Image в Phygital+

Qwen Image можно встроить в более крупный процесс создания дизайна. Текстовая модель подготовит структуру задания и точные формулировки. Блоки генерации изображений создадут персонажа, продукт или окружение. Qwen объединит или отредактирует исходные материалы, а отдельные ветки позволят проверить разные настройки камеры, композиции, LoRA и guidance. Утверждённый результат можно передать дальше для повышения разрешения или создания видео.

  1. Определите итоговый материал, текст и правила сохранения деталей.
  2. Создайте или соберите до трёх примеров с разными ролями.
  3. Создайте или отредактируйте изображение в Qwen Image.
  4. Проверяйте ракурсы, композиции и стили LoRA в отдельных ветках, меняя по одной переменной за раз.
  5. Проверьте текст, внешность персонажа, детали продукта и тени.
  6. Повысьте разрешение выбранного изображения или анимируйте его.

На холсте сохраняются связи между всеми исходными материалами и вариантами. Благодаря этому правки клиента проще повторить.

Стоимость Qwen Image в Phygital+

Qwen Image расходует кредиты Phygital. Актуальная стоимость отображается внутри блока до запуска генерации и может зависеть от выбранных настроек и количества изображений. Средства на балансе подписки также можно использовать в связанных блоках для работы с текстом, изображениями, видео и другими инструментами.

Частые проблемы с Qwen Image

Модель меняет слишком много деталей

Точно назовите область изменения и перечислите все важные элементы, которые должны остаться прежними.

Примеры противоречат друг другу

Назначьте каждому изображению одну роль и уберите дубли, в которых по-разному выглядят человек, форма продукта или стиль.

В тексте есть ошибки

Сократите текст, заключите его в кавычки, попросите не добавлять другие слова и проверьте результат в полном разрешении.

Элементы композиции выглядят вклеенными

Попросите модель согласовать перспективу, направление света, тени, цветовую температуру и глубину резкости.

Персонаж теряет узнаваемость

Используйте самое чёткое изображение лица как основной пример и не меняйте одновременно лицо, волосы, позу, ракурс и стиль.

Настройки камеры искажают объект

Меняйте угол небольшими шагами и явно указывайте, какие особенности человека или продукта должны остаться неизменными.

Текущие ограничения

Модель всё ещё может ошибаться при работе с плотным текстом, сочетанием языков, мелкими буквами, точными логотипами, сложными положениями рук и резкой сменой ракурса. LoRA и исходные изображения также могут направлять результат в разные стороны. Считайте созданные товарные знаки, текст на упаковке и утверждения, требующие юридического согласования, черновиками до проверки.

Вопросы и ответы

Что такое Qwen Image?

Qwen Image — семейство моделей Alibaba для генерации и редактирования изображений. Исходная версия 2025 года — модель 20B с открытыми весами, предназначенная прежде всего для отрисовки текста и редактирования по инструкциям.

Какая версия Qwen Image доступна в Phygital+?

На текущей странице модели описана исходная версия Qwen Image. Ориентируйтесь на настройки внутри блока: функции Qwen Image 3.0 API могут в нём отсутствовать.

Сколько исходных изображений можно использовать?

Блок Qwen Image в Phygital+ поддерживает до трёх исходных изображений.

Можно ли редактировать готовое изображение в Qwen Image?

Да. Подключите одно или несколько изображений и опишите нужное изменение, а также детали, которые должны остаться неизменными.

Хорошо ли Qwen Image работает с текстом?

Да, особенно с текстом на китайском и английском языках. Другие системы письма тоже могут работать, но каждый готовый материал необходимо вычитывать.

Можно ли использовать LoRA?

Да. Блок Phygital+ поддерживает обученные LoRA и готовые модификаторы с регулируемой силой воздействия.

Какие разрешения доступны?

На текущей странице модели в Phygital+ указаны размеры сторон от 512 до 1664 пикселей и несколько готовых соотношений сторон.

Чем Qwen Image отличается от Qwen Image 3.0?

Qwen Image 3.0 — более новое облачное семейство с генерацией и редактированием, настройками рассуждения, поддержкой до трёх примеров и разрешением до 2048×2048. Исходная модель — отдельная версия с открытыми весами.

Сколько стоит Qwen Image в Phygital+?

Модель расходует кредиты Phygital, а актуальная стоимость отображается внутри блока до запуска генерации.

Зачем использовать Qwen Image в Phygital+?

В Phygital+ можно на одном холсте подготовить задание и исходные изображения, выполнить генерацию и редактирование в Qwen, сравнить варианты с LoRA, повысить разрешение результата и создать видео.

Explore more

nanobanana

Гайд по Nano Banana Pro: постеры с точным текстом, реклама и брендовые визуалы в 4K в Phygital+

Как использовать Nano Banana Pro (Gemini 3 Pro Image) для точного текста в изображениях, брендовых визуалов по нескольким референсам и студийных правок. Сравнение версий, промпты, FAQ и рабочий процесс в Phygital+.

FLUX2

Гайд по FLUX.2: фотореалистичные визуалы товаров и правки по нескольким референсам в Phygital+

Как использовать FLUX.2 для фотореалистичной генерации, согласованности по нескольким референсам и правок для продакшена. Сравнение вариантов, структура промпта, примеры, FAQ и рабочий процесс в Phygital+.

Российская Федерация
ООО «АЙ-СПЕЙС»
101000 г. Москва, ул. Мясницкая, д. 30/1/2, стр. 2, помещ. 1/Ч
ИНН/КПП 7721481180/770101001
ОГРН 1167746316462 — data
Email: we@phygitalism.com

Правила и условия

Российская Федерация
ООО «АЙ-СПЕЙС»
101000 г. Москва, ул. Мясницкая, д. 30/1/2, стр. 2, помещ. 1/Ч
ИНН/КПП 7721481180/770101001
ОГРН 1167746316462 — data
Email: we@phygitalism.com

Правила и условия