Проверка AI-агента начинается до запроса
Пять документов по одной задаче редко описывают одну и ту же реальность. Официальный контракт относится к новой версии API, Confluence хранит старую схему, прототип написан год назад, а последнее ограничение осталось в переписке. Если сразу попросить агента подготовить спецификацию, он соберёт один связный ответ. Вместе с формулировками он незаметно склеит версии системы. Сначала видимость конфликта До основного запроса каждому источнику нужны дата, владелец и статус. Отдельная колонка показывает, с чем источник расходится. Эта карта не решает конфликт. Она делает его видимым и не позволяет принять гладкость текста за согласованность фактов. Три разных результата Подтверждённый факт содержит ссылку на действующий источник. Противоречие показывает две версии без автоматического выбора. Решение фиксирует, кто выбрал вариант и по какому критерию. Если агент сам превратил противоречие в решение, результат нельзя считать проверенным. Он просто заполнил пробел наиболее правдоподобным продолжением. Например, официальный контракт требует OAuth 2.0, старый прототип использует API Key, а страница во внутренней базе знаний не указывает версию. Нельзя выбирать наиболее подробный источник или самый свежий файл автоматически. Сначала команда определяет, какой документ задаёт действующий контракт, а затем записывает, почему отвергла остальные варианты. Проверка в обратную сторону Не перечитывайте документ только сверху вниз. Возьмите ключевые утверждения и пройдите от каждого к основанию: • где это написано; • для какой версии действует; • какой источник спорит; • кто принял окончательное решение. После этого утверждения можно переводить в пользовательские сценарии и исполняемые критерии приёмки. Зелёный тест докажет, что агент реализовал заданное поведение. Человек всё равно должен решить, то ли поведение было задано. Так проверяемость проходит через весь процесс. Карта источников не даёт смешать версии. Запись решения не даёт потерять критерий выбора. Пользовательский сценарий связывает решение с наблюдаемым поведением. Каждый слой отвечает на свой вопрос, и ни один не приходится восстанавливать по уверенности ответа.