Сфоткал огрызок сыра — получил суфле
Традиционный способ получить рецепт от ИИ — переписывать содержимое холодильника вручную. Это похоже на средневековую алхимию: вы тратите пять минут на описание «два яйца, плавленый сырок, пол-литра кефира, вялый укроп», надеясь, что нейросеть не перепутает петрушку с сельдереем. А потом она предлагает запеканку из кефира и укропа. Эффективность нулевая.
Современные мультимодальные модели (GPT-4V, Claude 3, Gemini) умеют видеть. Эволюция не зря подарила нам зрение — картинка стоит тысячи токенов. Не описывайте реальность, показывайте её. Сфотографировали открытый холодильник, загрузили в чат, написали «предложи рецепт». Всё. ИИ сам распознает огурцы, страдающие от холода, и заплесневелую сметану. Никаких списков.
Принципы (коротко):
1. Фото заменяет 50 слов. 2. Не пишите «примерно 150 граммов» — ИИ оценит объём сам. 3. Чётко ставьте задачу: «только то, что видно», «игнорируй пустые бутылки».
Примеры. ❌ Как не надо: «Уважаемый ChatGPT, в моём холодильнике обнаружены: куриное яйцо (2 шт.), коровье молоко жирностью 2,5% (около 300 мл), сыр “Российский” (кусок 50 г)...» — вы так и до пенсии будете перечислять.
✅ Как надо: открываете камеру, щёлк, прикрепляете фото, пишете: «Сделай из этого ужин, не убивающий вкусовые рецепторы».
Пример промпта (рабочий): «Вот фото моего холодильника. Проигнорируй засохшую кинзу и одинокий лимон. Предложи рецепт на 20 минут, используя только то, что видно. Если не хватает соли, перца, масла — считай, что они есть в шкафу. И никакой квашеной капусты с ананасом, пожалуйста».
Мультимодальность — это не магия, а логичная экономия времени: вместо описания реальности вы просто показываете её.
Коллеги, кто-нибудь уже кормил ИИ фото забитой кладовки или полки с просроченными консервами?