Как заставить ИИ признать ошибки

Вы наверняка сталкивались: пишете запрос, получаете красивый текст с уверенной ложью. Проблема не в «магии промптов». Проблема в том, что нейросеть не имеет внутреннего критика. Она – аналог спинного мозга, а не лобной коры.

Но есть обходной путь, достойный любой биологической эволюции: заставить модель оценить себя же.

Суть до неприличия проста. 1. Получаем ответ. 2. Не бросаемся править руками. Вместо этого пишем второй промпт: «А теперь будь честным рецензентом. Найди в своём прошлом ответе неточности, логические дыры и откровенный бред. Перепиши заново, чтобы стыдно не было». 3. На выходе – качество взлетает на 20%. Это не эзотерика, это подтверждённые цифры (см. работу «Self-Refine: Iterative Refinement with Self-Feedback», Madaan et al. 2023).

Почему метод работает? Первый ответ – быстрый паттерн, второй – попытка взглянуть на себя со стороны. Аналог: вы написали статью, отложили на час, прочитали – и сами нашли 50 ошибок. Только здесь ИИ делает это за 5 секунд.

Примеры для наглядности

❌ Тупой подход: Вы: «Пять идей для поста». ИИ: «1. Котики, 2. Кофе, 3. Смысл жизни...» Вы: «Нет, переделай». И пишете 10 минут уточнений.

✅ Умный подход: Вы: «Пять идей. А теперь, сударь, критикуйте себя. Где банальность? Где фактическая ошибка? И перепишите». ИИ выдаёт реально работающие темы.

Рабочий промпт (берите и пользуйтесь) \\ Шаг А: Объясни, почему нейросети галлюцинируют. Шаг Б: Прокритикуй своё объяснение – найди минимум два упрощения. Шаг В: Исправь и выдай финальный, адекватный ответ. \\

Добавьте один промпт самокритики – и нейросеть перестанет быть оптимистичным дураком.

Вопрос к знатокам: вы верите, что ИИ способен на настоящую самооценку, или это просто пересчёт вероятностей с другой маскировкой?

Как заставить ИИ признать ошибки | Сетка — социальная сеть от hh.ru