Как заставить ИИ признать ошибки
Вы наверняка сталкивались: пишете запрос, получаете красивый текст с уверенной ложью. Проблема не в «магии промптов». Проблема в том, что нейросеть не имеет внутреннего критика. Она – аналог спинного мозга, а не лобной коры.
Но есть обходной путь, достойный любой биологической эволюции: заставить модель оценить себя же.
Суть до неприличия проста. 1. Получаем ответ. 2. Не бросаемся править руками. Вместо этого пишем второй промпт: «А теперь будь честным рецензентом. Найди в своём прошлом ответе неточности, логические дыры и откровенный бред. Перепиши заново, чтобы стыдно не было». 3. На выходе – качество взлетает на 20%. Это не эзотерика, это подтверждённые цифры (см. работу «Self-Refine: Iterative Refinement with Self-Feedback», Madaan et al. 2023).
Почему метод работает? Первый ответ – быстрый паттерн, второй – попытка взглянуть на себя со стороны. Аналог: вы написали статью, отложили на час, прочитали – и сами нашли 50 ошибок. Только здесь ИИ делает это за 5 секунд.
Примеры для наглядности
❌ Тупой подход: Вы: «Пять идей для поста». ИИ: «1. Котики, 2. Кофе, 3. Смысл жизни...» Вы: «Нет, переделай». И пишете 10 минут уточнений.
✅ Умный подход: Вы: «Пять идей. А теперь, сударь, критикуйте себя. Где банальность? Где фактическая ошибка? И перепишите». ИИ выдаёт реально работающие темы.
Рабочий промпт (берите и пользуйтесь) \\ Шаг А: Объясни, почему нейросети галлюцинируют. Шаг Б: Прокритикуй своё объяснение – найди минимум два упрощения. Шаг В: Исправь и выдай финальный, адекватный ответ. \\
Добавьте один промпт самокритики – и нейросеть перестанет быть оптимистичным дураком.
Вопрос к знатокам: вы верите, что ИИ способен на настоящую самооценку, или это просто пересчёт вероятностей с другой маскировкой?
· 24.07
Здесь подходит принцип того, что модель обучаема, значит и может обучиться на своём опыте тоже
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён