ИИ собирает интерфейсы на лету. Что это меняет в разработке? Увидел ролик OpenAI про Intelligent UI. ChatGPT под задачу собирает интерактивный интерфейс прямо в чате.
Мы привыкли заранее продумывать, какие данные человек увидит, какие действия сможет выполнить, что произойдет дальше. Прототипы делаем. Теперь часть этих решений можно передать модели. У OpenAI она собирает ответ из библиотеки компонентов, подготовленных разработчиками и дизайнерами.
Решил посмотреть исследования Generative UI. В работе Google на 100 запросах оценщики предпочитали сгенерированные интерфейсы текстовым ответам. Но страницы, сделанные специалистами, оставались впереди, а время генерации в сравнении не учитывали.
У исследователей из Stanford генеративный интерфейс предпочли текстовому ответу GPT-4o в 69% сравнений. При этом задачи были тестовыми, без серверной логики, а генерация могла занимать несколько минут. Пока это свидетельство предпочтения, а не доказательство, что работать стало быстрее.
В той же работе есть пример: на запрос «Как научиться играть на пианино?» система создает тренажер с обратной связью в реальном времени. Пользователь просит помочь научиться, а модель сама выбирает, какой инструмент предложить.
И проверять здесь нужно несколько вещей: работают ли элементы управления, правильно ли тренажер реагирует на действия и помогает ли он учиться. Компоненты можно проверить заранее, но конкретный инструмент появится уже у пользователя.
Мне интересно, станет ли это таким же привычным способом взаимодействия, как жесты и свайпы на смартфоне. Мы привыкли, что интерфейс уже существует и нужно разобраться, как им пользоваться.
Пока все это выглядит как замена текстового интерфейса, но кто знает, куда это пойдет, если все будет в чате с нейронками. Будем ли мы через несколько лет так же привычно просить нужный интерфейс, как сегодня свайпаем экран пальцем?