Легко представить, будто генерация изображений в ChatGPT была всегда: сегодня это одно из самых привычных решений в этой области. Трудно поверить, но функция появилась у пользователей лишь в марте 2025 года.
Год спустя, в апреле 2026-го, модель получила ещё одно крупное обновление. На этот раз разработчики сосредоточились на удобстве работы и новых функциях.
Больше всего мне понравилась смена соотношения сторон в один клик — удивительно, что её не добавили раньше. Я постоянно забываю указать размер, а теперь можно сначала поработать над визуальной частью, затем в том же чате адаптировать результат под разные площадки и форматы… Даже не верится, что всё настолько просто!
Долгое время даже самые сильные генераторы изображений подводили в повседневной работе: текст искажался, композиция инфографики рассыпалась, а пригодный результат удавалось получить лишь после бесконечных проб. Судя по обновлению, OpenAI хочет превратить генерацию изображений из эффектной новинки в полноценный рабочий инструмент. Пожалуй, это главное изменение. Но обо всём по порядку.
В этой статье разберём обновление за апрель 2026 года, его новые возможности и способы составлять точные промпты. Вы узнаете:
- как составлять промпты на профессиональном уровне;
- как креаторы используют сгенерированные изображения в реальных задачах;
- насколько лучше модель стала понимать сложные запросы.
Как составлять промпты для ChatGPT Image в 2026 году
GPT Image 2.0 внимательнее следует инструкциям, поэтому формулировка запроса стала ещё важнее. Лучший результат получается, когда вы описываете конкретный итог, а не общее настроение. Разберём, как усилить промпт.
Не пытайтесь уместить всё в одну длинную фразу. Соберите описание результата из отдельных блоков, которые легко менять. Такой промпт проще расширять и уточнять, а последовательные правки не превращаются в хаос.
Описывайте изображение последовательно: сначала общую композицию, затем стиль, типографику, цвет и второстепенные детали. Для современных моделей генерации изображений такая структура работает особенно надёжно.
| Компонент | Что указать | Пример |
|---|---|---|
| Объект | Что будет главным объектом? | Допустим, яблоко. |
| Сцена | Где всё происходит? | Яблоко лежит на столе. |
| Композиция | Ракурс, кадрирование или расположение элементов. | Крупный план яблока на столе. |
| Стиль | Визуальное направление. | Гиперреалистичный крупный план блестящего яблока на столе. |
| Детали | Текст, оттенки, фон и другие подробности. | Добавьте на яблоко маленькую жёлтую наклейку со смайликом. |
Заметили проблему? Даже в этом примере модели приходится додумывать часть деталей, поэтому результат остаётся непредсказуемым.
Какого цвета должно быть яблоко? GPT Image не задаст этот вопрос, а попробует угадать. Чтобы результат был стабильнее, указывайте все важные детали в начале промпта.
Теперь о длине. Короткий промпт оставляет модели простор для творчества, но порой в кадре появляются совсем неуместные детали. Хороший промпт содержит всё необходимое и при этом не перегружен.
Если вы только начинаете, представьте, что ставите задачу приглашённому дизайнеру. Приложите референсы и дайте достаточно подробностей, сохранив понятную логику. С моделями этот подход тоже работает: они понимают обычный человеческий язык.
ChatGPT Image 2.0 стал ещё лучше создавать изображения
Сравним обновлённую версию 2.0 с её предшественницей GPT Image 1.5 и заодно посмотрим, почему подробный промпт помогает лучше управлять результатом.
Пример очень короткого промпта
A nice product photo for social media
Пример подробного промпта
A clean product photo of a skincare bottle placed on a beige stone surface, soft natural lighting, minimal shadows, centered composition, shot from a slightly elevated angle, with space above for text, modern Pinterest-style aesthetic
Разница между версиями 1.5 и 2.0 заметна сразу. После обновления GPT Image точнее следует инструкциям и создаёт более современный дизайн. Особенно сильно улучшилась генерация текста — настолько, что ChatGPT теперь охотно добавляет его повсюду.
Что нового в GPT Image 2.0
Пока каждое изображение генерируется немного дольше, но результат стоит ожидания. Новая модель лучше управляется с композицией и ракурсами: теперь вы можете почувствовать себя фотографом и режиссёром. Нескольких слов достаточно, чтобы изменить перспективу и добавить кадру динамики.
Отдельно отмечу, что GPT Image стала полезнее для бизнеса и креаторов, которые визуализируют сложные данные. Инфографика, необычные диаграммы и последовательная сборка презентаций теперь получаются заметно лучше.
Одно из самых полезных нововведений — точечное редактирование. Можно выделить область изображения и изменить только её с помощью дополнительного промпта. Раньше даже небольшая правка могла полностью преобразить картинку. Теперь процесс гораздо предсказуемее: требуется меньше итераций, кредитов и нервов.
Как улучшить генерацию изображений с текстом
Главное улучшение ChatGPT Image 2.0 — качество текста на изображениях. Для прикладного дизайна это меняет многое. Точная передача надписей особенно важна там, где текст становится частью композиции: на слайдах презентаций, обложках видео, в цифровой и печатной рекламе, публикациях для соцсетей и промоматериалах вроде кадров с косметикой из нашего примера.
Улучшение дало забавный побочный эффект: теперь GPT Image стремится добавить текст буквально везде. В таких случаях пригодится негативный промпт.
Версия 2.0 отлично справляется и с рукописным текстом. Заметки на бумаге, надписи маркером, каракули на упаковке, небрежный леттеринг и даже сложные фразы выглядят естественно. Если трудно объяснить расположение надписи, набросайте её на бумаге и отправьте фотографию в чат как референс.
Для текста на сгенерированных изображениях лучше всего работают простые правила:
- Заключайте точный текст в кавычки.
- Не делайте надпись слишком длинной: она должна естественно помещаться в композицию.
- Указывайте место для текста: на этикетке, вывеске и так далее.
Для эксперимента я дала модели сложное задание: написать текст и встроить его в сцену. Название профессии должно было появиться на спинке каждого стула в оживлённом рисованном офисе с несколькими персонажами. Сложности достаточно, чтобы всё могло пойти наперекосяк.
Во время доработки GPT допустила забавную ошибку: на одном из стульев появилась надпись PROOFREEGAL. Так родилась новая профессия — что-то среднее между корректором и помощником юриста. Впрочем, исправить слово оказалось легко и без Photoshop. В следующей итерации я просто выделила неверную надпись и заменила её, не меняя остальное изображение. Вуаля!
Как задавать ракурсы в новой GPT Image 2.0
Одно из главных улучшений этой версии — управление композицией. Теперь модель гораздо точнее соблюдает кадрирование, особенно если использовать профессиональные обозначения.
Смена ракурса — один из самых простых способов повлиять на настроение кадра и восприятие героя. Фронтальный вид на уровне глаз выглядит нейтрально и понятно. Нижний ракурс делает объект крупнее, сильнее и драматичнее. Верхний — меньше, мягче или уязвимее. Так можно выстроить целую историю, что особенно полезно при создании первого и последнего кадров для генерации видео.
Всего несколько слов в промпте заметно меняют результат. Но формулируйте их точно: «кинематографичный ракурс» слишком расплывчато. «Портрет на уровне глаз, объект по центру» даёт модели гораздо более ясный ориентир. Подойдут и такие варианты, как «снято немного сверху», «фронтальный крупный план» или «общий план с нижнего ракурса, объект ближе к переднему краю».
Как дорабатывать изображения итерациями
Не пытайтесь получить идеальную картинку с первой попытки — дорабатывайте промпт поэтапно. Меняйте по одному параметру: например, оставьте объект прежним, но скорректируйте указания для камеры.
Итерации помогают точнее сформулировать желаемый результат. Это полноценный творческий процесс, который нередко приводит к решению лучше первоначального замысла.
Если изображение выглядит перегруженным, точнее опишите план и композицию. Добавьте определения вроде «крупный план», «средний план», «общий план», «по центру», «симметрично», «вид сверху» или «на уровне глаз».
Если теряется главный объект, сократите количество предметов, стилевых указаний и действий, которые перетягивают внимание.
Возникли проблемы с текстом? Сократите его и поместите указание в логичную часть промпта, чтобы модели было проще его обработать.
Как креаторам использовать GPT Image
Для творческой работы GPT Image ценна тем, что быстро создаёт изображения нужного типа и даёт достаточно контроля для реальных процессов. Попробуйте её в разных задачах — и вы наверняка перестанете воспринимать модель как узкоспециализированный генератор картинок.
GPT Image 2.0 поможет создавать визуальные концепции для соцсетей, обложки каруселей, превью и карточки с цитатами. В маркетинге модель быстро подготовит черновики рекламных креативов, баннеры с текстом, промоматериалы и композиции с продуктом в сцене. До настоящей съёмки можно собрать стилизованные сцены в духе Pinterest, лайфстайл-кадры, имитацию пользовательского контента или мудборд кампании.
Среди практичных и порой неожиданных сценариев — визуализация сложной аналитики и создание диаграмм, где данные превращаются в фирменную или тематическую графику.
Разумеется, модель подходит и для обработки фотографий: она расширяет фон, убирает лишние детали, меняет кадрирование и создаёт версии под разные форматы, сохраняя лицо человека. И всё это без долгой ручной работы — красота!
Частые вопросы
Как отредактировать изображение из ChatGPT, не генерируя его заново?
Теперь изображения в ChatGPT можно редактировать двумя способами: выделить нужную область инструментом выбора и описать изменение либо написать правку в чате, чтобы модель применила её шире. Для практических дизайнерских задач это заметно упрощает работу, особенно когда изображение почти готово и нужно исправить лишь одну надпись, объект или участок. Точечное редактирование, описанное в статье, действительно доступно и официально поддерживается.
Какое референсное изображение загрузить для работы с ChatGPT Image 2.0?
Для изображения продукта загрузите качественный исходник с объектом, который нужно сохранить. Референсом также могут служить композиция, форма, элементы фирменного стиля, характер надписей или настроение. ChatGPT поддерживает файлы PNG и JPEG размером до 20 МБ каждый, а также умеет работать с неаккуратными скриншотами, рисунками от руки, набросками, черновиками и противоречивыми референсами. Чем яснее исходное изображение, тем меньше модели приходится додумывать и тем реже возникают странные сюрпризы.
Почему изображения в ChatGPT теперь генерируются так долго?
На создание сложного изображения может уйти до двух минут: модель выполняет больше операций и не выдаёт идеальный результат мгновенно. Картинки стали гораздо пригоднее для рекламы, публикаций в соцсетях, диаграмм и макетов, но на обработку нужно время. При высокой нагрузке ожидание в очереди тоже увеличивается.