👴🏻В продакшене LLM имеют свойство быстро устаревать — все, что произошло после даты их обучения, они просто не знают.

Наш хэд бэкэнд-разработки Женя сумел частично решить эту проблему с помощью Retrieval Augmented Generation. Вместо дорогого файн-тюнинга RAG подтягивает свежие документы из баз или интернета и подмешивает их прямо в промпт.

Как настроить RAG-конвейер, чтобы ответы были быстрыми и дешевыми, и на каких данных технология даст максимальный эффект? Рассказываем в новой статье.