OpenAI выпустила ChatGPT Images 2.0 с логическим мышлением и веб-поиском
OpenAI представила обновленную систему генерации изображений, которая решает классические проблемы нейросетей: искаженный текст, нарушение композиции и игнорирование инструкций. Теперь модель сначала обдумывает запрос, ищет актуальную информацию в сети для точности деталей и создает до восьми согласованных вариантов в высоком разрешении.
Инструмент поддерживает любые форматы от баннеров до мобильной графики и корректно вписывает типографику в макеты интерфейсов и постеры.
Ссылка: https://openai.com/index/introducing-chatgpt-images-2-0/ @AIandproducts
· 23.04
Интересно что OpenAI делает ставку на reasoning в генерации изображений — это принципиально другой подход чем диффузионные модели. По факту это первый шаг к тому чтобы AI понимал "почему" картинка должна выглядеть так, а не просто "какой текст ей соответствует". В продакшене уже тестирую для генерации UI-мокапов к постам — скорость впечатляет, но консистентность между итерациями пока слабее Midjourney.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён