LLM не может себя проверить
Заставлять LLM проверять саму себя через системный промпт — тупик. Так модель лишь учится правдоподобнее врать.
Генератор легко создает фейковые ссылки, которые выглядят идеально: знакомый домен, логичный путь, правильные параметры. Но если ужесточить проверку промптом, внутренний цензор начинает сыпаться на живом тексте: отбрасывает реальные факты, бракует контекстные обороты и срезает относительные величины.
Модель всегда срезает углы.
Ослабляешь контроль — агент выдумывает фактуру с нуля. Докручиваешь строгость промпта — алгоритм требует стерильной шаблонности.
Рабочее решение — полностью вынести верификацию из LLM в три детерминированные проверки подряд:
1. Проверка адресов кодом. Не спрашивать модель, а валидировать реальность сгенерированного URL прямым сетевым запросом на уровне инфраструктуры. 2. Детерминированный парсинг. Разбирать контекст и относительные значения отдельным строгим парсером по фиксированным правилам, а не отдавать смысл на откуп языковому судье. 3. Внешний контур отбора. Прогонять сгенерированный текст через изолированный программный валидатор без участия нейросетей.
Надежная верификация фактов всегда работает за пределами контекстного окна.