GPT плохо работает с документами в базе знаний. Что делать?
Есть такая проблема: ты умница, промт написала, базу знаний от клиента в виде разных там файлов получила, все загрузила. А этот гад скачет по верхам или выдумывает что-то свое. Три раза в разных местах подписываешь в промте «пожалуйста, обращайся к свой базе знаний, пожалуйста, ну пожаааалуйста». Фигушки!
Волшебство в том, что все файлы нужно конвертировать в формат markdown. Хуже всего для этого подходят PDF-файлы, поэтому и работает с ними чятик хуже. Лучше заморочиться, перевести PDF сначала в DOCX, а потом в markdown. Так информация внутри файла будет размечена понятным для машины способом, а токенов потратится меньше (это важно, если работать с GPT не в интерфейсе чятика, а интегрировать его в мессенджер или на сайт).