Вот как надо: полный гайд по промптам ChatGPT Images 2.5
Всё ещё используете нейросети для генерации красивых картинок? Ну-ну. Официальный гайд OpenAI для Image 2.5 предлагает использовать модель для создания комиксов, интерфейсов, инфографики, презентаций, упаковки, рекламы, примерки одежды, перевода текста на изображениях и ещё десятка задач. Потыкал модельку, прочёл гайд — самое важное собрал в этом посте.
Чем новая модель может похвастаться: генерация более детализированных изображений; естественное освещение; естественные текстуры; более точное следование инструкциям и более внятное многоэтапное редактирование.
Главная мысль руководства: перестаньте писать заклинания на пять страниц и 200 тегов. Для адекватного и прогнозируемого результата (а это самое важное в генеративном ИИ) OpenAI предлагает описывать всего четыре вещи: что находится в кадре; композиция; стиль; ограничения. Это что касается именно генерации. Теперь по полезностям и фишкам.
Редактируйте по одному элементу за раз, не нужно переписывать весь промпт. Нужно добавить снег? Добавляйте. Вечер вместо утра? Так и пишите. Одна итерация — одно изменение, так меньше вероятность деградации остальных деталей. И не забывайте явно фиксировать то, что трогать нельзя: прямо перечисляйте всё «запретное».
Для текста используйте слово «exactly». Например: «Размести текст exactly as written: "Нейрочеловек". Только один раз. Без дополнительного текста». Мелочь, но самодеятельность резко снижается.
Перевод текста на картинках. Можно взять инфографику или инструкцию и написать: «Переведи весь текст на [нужный язык]. Не меняй ничего, кроме текста». Крайне полезно для презентаций, инструкций, рекламы и локализации контента.
Логотипы. Здесь прямо красота — описывайте бренд и формы, которые должны определять будущий знак. Можно задавать количество вариантов, добавлять подписи.
Прозрачность! Как много в этом слове... Параметр «background="transparent"» и вуаля — ваша иллюстрация сразу с прозрачным фоном.
Исторический и реальный контекст. Можно задать точное место и дату, добавить что-то вроде «одежда, обстановка и окружение должны точно соответствовать духу того времени.» и всё будет прекрасно.
К сожалению, объём публикации ограничен, поэтому просто перечислю, что перечисляется в руководстве, чтобы ваш процесс генерации и обработки картинок вышел на новый уровень: — фотореалистичные изображения с контролем стиля и освещения, в том числе управление оптикой и кадрированием; — визуальное объяснение процессов: инфографика, схемы, диаграммы и прочая визуализация; — изображения с точным текстом; — логотипы и фирменная графика: варианты, композиция и идентичность; — исторические и реальные сцены, я бы даже сказал — исторически-реалистичные; — превращение истории в комикс; — интерфейсы и UI-макеты: приложения, веб-интерфейсы, сервисы, продуктовые концепты; — научные и образовательные визуализации; — презентационные слайды; — перевод текста на изображениях на другой язык; — перенос визуального стиля с референса на новое изображение или переработку существующего; — смена одежды с сохранением личности (здесь гусары, конечно, могут выразительно помолчать); — объединение нескольких изображений — стилистически или объектно; — создание вырезанного объекта с прозрачным фоном; — точечное удаление предмета без перестройки сцены; — помещение человека (любого объекта) в новую сцену; — замена мебели и элементов интерьера на фото.
И невозможно обойти вниманием новую фишку: функцию Sketch — превращение рисунка в реалистичное изображение. Схема: пишете в чате «@sketch», рисуете набросок (он будет использован как базовый референс), дополняете промптом — на выходе красота, как будто художнику/фотографу/дизайнеру показали и рассказали, что и как должно получиться.
Пользуйтесь на здоровье 🤘🏻
⚡ @neuro_man