HyDE vs RAG
https://beyondscale.tech/blog/hyde-vs-rag-retrieval-augmented-generation
TLDR; можно попросить нейросетку сначала сгенерировать ответ, а потом уже по нему искать. Это подходит когда терминология запроса может отличаться от терминологии документов, но требует больше токенов и времени.