Продолжаю шарманку про субсессионный режим, потому что могу.
Использовал в кейсе, который показывает классность. Итак, допустим, вы делаете какого-то помощника, цель которого — отвечать на вопросы. Но при этом вы хотите его в некоторых случаях ограничивать, а в некоторых помогать ему давать верные ответы.
Задача для 26 года довольно простая, но есть момент. Он в том, что нельзя сделать чат, который взлетит с первого раза. Просто потому что такие чаты дообучаются. Типа раскатываешь его на 100 человек, смотришь ответы, вносишь правки и кидаешь ещё на 100 человек. И так постепенно раскатываешь. Это требует времени и пропускает очевидные ошибки.
Ну или пропускал.
Что можно сделать с субсессионным режимом, который не ограничен субагентами. Генерируем выборку в 1000 вопросов. Дальше просим основной чат — чтобы он прогонял живые вопросы и получал ответы, после чего анализировал их по правилу, и если ответ не ок, то он отправляет в отдельную сессию контекст для исправления. Сейчас я сделал такой кейс, и за 18 часов автономной работы я улучшил количество качественных ответов со стартовых 78% до 94%.
Дальше все равно надо будет его гонять на реальных данных, но слой очевидных ошибок мы сняли.