Попросите у своего ChatGPT: Назови случайное число от 0 до 10 А потом откройте спойлер.
Он написал вам семёрку?
Пару дней назад услышала об этом от Алексея DNative. И сразу пошла проверять у своего чата, с которым работаю уже больше двух лет и у которого накопилось довольно много памяти обо мне: он ответил той самой цифрой под спойлером.
После чего я спросила: Почему у многих пользователей ты выбираешь именно это число?
Он объяснил, что число 7 часто воспринимается людьми как самое случайное. Оно нечётное, простое, находится ближе к середине диапазона и культурно очень заметно: семь дней недели, семь чудес света и так далее. В текстах, на которых обучались языковые модели, люди тоже непропорционально часто отвечали семёркой на просьбу назвать случайное число. ChatGPT усвоил этот паттерн.
Технически модель работает примерно так: получает запрос, рассчитывает вероятности возможных продолжений и выбирает одно из них. Условно: 7 — вероятность 35% 3 — 18% 5 — 14% 9 — 11% Цифры здесь для примера. Реальное распределение нам недоступно.
Если система выбирает самый вероятный ответ, семёрка будет появляться снова и снова. Если используется вероятностная выборка, будут выпадать и другие числа, но варианты с большей вероятностью всё равно будут встречаться чаще.
То есть ChatGPT не запускает внутри себя честную жеребьёвку, где каждое число имеет одинаковый шанс. Он продолжает текст так, как это чаще всего происходило в похожих ситуациях. Как понимаете, это касается не только чисел.
Мы с ним ещё немного поговорили и пришли к нескольким выводам. ▪️Риск банальности выше, когда запрос короткий: придумай идею, назови ассоциации, сделай красиво. Недостающие условия модель заполняет наиболее вероятными решениями. ▪️В творческих задачах ChatGPT первым часто предлагает вариант, который уже много раз встречался в похожем контексте. Он может быть нормальным, но он будет предсказуемым. ▪️ В аналитических вопросах возникает другой риск: чрезмерно общий ответ, который звучит разумно, но почти ничего не даёт для решения задачи. ▪️ Просьба предложи что-нибудь необычное не всегда помогает. Модель может выбрать распространённое представление о необычном: неожиданную метафору, яркий цвет, игру слов или странный сюжет. Получается шаблонная оригинальность.
После нового понимания я опять обновила общие инструкции для задач, где требуется креативное мышление. У меня это, например, разработка мерча, сюжетов для принтов + товарных линеек. Теперь в таких задачах я прошу сначала определить очевидные решения и убрать их из выдачи.
Вместо: Придумай пять идей
можно написать: Сначала определи три наиболее очевидных решения и не предлагай их. Найди варианты с разной логикой. Избегай необычности ради необычности
Ещё несколько полезных формулировок: ▪️ Не выбирай самый популярный ответ. ▪️Избегай решений, которые обычно выдаёт большинство. ▪️Предложи варианты, построенные на разных принципах, а не пять вариаций одной идеи. ▪️Сначала назови шаблонное решение, затем исключи его. ▪️Проверь, не выглядит ли идея необычной только на фоне совсем банальных вариантов.
Большим лайфхаком это не назову. Скорее, это напоминание о том, как работает языковая модель.
В этом посте были ссылки, но мы их удалили по правилам Сетки