Привет ✋ Давно меня здесь не было. Всё меняется. Я никак не могла понять, в какую сторону двигаться.
Решила немного расширить формат канала. Системный анализ останется, а ещё буду рассказывать про иишку, автоматизацию и мои практические/личные кейсы 👌
Мне не нравится нейрослоп про инструменты и решения, поэтому буду рассказывать о том, что и как использую лично я.
Пока я готовлю материал, делюсь просто интересными фактами:
🧐 Даже иишке недостаточно просто дать спецификацию API. Во внутренних тестах Anthropic добавление примеров вызовов повысило точность работы со сложными параметрами с 72% до 90%. Формально корректный запрос ещё не означает, что инструмент использован правильно
🧐 Переписать описание инструмента иногда полезнее, чем менять модель. В Anthropic агент тестировал инструменты, находил неясности и улучшал их описания. После этого другие агенты тратили на 40% меньше времени на выполнение задач, потому что совершали меньше ошибок. Кажется, документация становится частью работающей системы
🧐 ИИ может работать точнее, если давать меньше лишней информации. В тестах Anthropic агенту перестали загружать инструкции ко всем инструментам сразу. Вместо этого он находил нужный инструмент и читал, как им пользоваться. Точность на тестах выросла с 49% до 74%, хотя модель осталась той же. Получается, важно не только что дать иишке, но и когда
IT Talks | Ошуркова Татьяна
В этом посте были ссылки, но мы их удалили по правилам Сетки