Agentic scale
Масштабирование финтеха часто упирается в пропускную способность комплаенс-кластера. Мы пофиксили это узкое место, заменив ручную верификацию локальной агентной архитектурой
Фулл-human бэк-офис негативно аффектит на маржу. Наш AML/KYC теперь работает на автономном агентном контуре (лан лан, ребята за роботами присматривают)
Архитектура решения:
Recursive Task Decomposition. Агенты самостоятельно дробят проверку на подзадачи: от графового анализа связей до верификации санкционных списков.
Adversarial Validation. Галлюцинации исключены через перекрестный допрос моделей. Конфликт логики подсвечивает ошибки до выгрузки отчета.
Local RAG. Инъекция актуальной нормативной базы в контекст. Система оперирует правом, а не вероятностями.
Метрики:
Latency: 40 секунд на сложный кейс (было 3 часа).
Throughput: Пропускная способность отдела выросла в 12 раз.
OPEX: Затраты на верификацию ограничены стоимостью инференса.
Это переход к масштабируемому локальному интеллекту. Построено на кастомном стеке, работает в закрытом контуре.
· 27.04
интересно как решили вопрос с обновлением нормативной базы в local rag - это ручной процесс или есть автоматический триггер на новый документ. спрашиваю потому что у меня был похожий кейс - время от появления изменений до попадания в контекст критично, делал через celery beat + пересборка индекса, но это всё равно лаг в несколько минут
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён
· 27.04
Для изоляции кейса тайминг ок. В полноценном скейлинге - hot/cold rag и upsert. Иначе это скрипт по расписанию
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён