Caveman: плагин Claude Code, который экономит 75% токенов

Плагин Caveman заставляет ИИ-ассистента отвечать как пещерный человек — только суть. Средняя экономия output-токенов составляет 65–75%, а научное исследование 2026 года подтвердило, что краткость повышает точность моделей.

Каждый раз, когда ИИ-ассистент объясняет вам очевидное в трёх абзацах, вы платите за это токенами. Output-токены дороже input, а модели вроде Claude и GPT-4 любят добавлять вводные фразы, повторять вопрос и объяснять то, о чём вас не спрашивали. Разработчики, которые активно используют ИИ в работе, тратят на это сотни долларов в месяц.

Плагин Caveman решает эту проблему радикально: он заставляет ИИ-ассистента отвечать как пещерный человек — только самое необходимое. Никакого «The reason your component is re-rendering is likely because…» — только «New object ref each render. Wrap in useMemo.» По данным автора, в среднем экономия составляет 75% output-токенов. На Hacker News проект набрал 797 очков, на GitHub — 2,8K звёзд за несколько дней.

• Caveman сокращает output-токены в среднем на 65–75%, не затрагивая «мышление» модели

• Работает как плагин для Claude Code и OpenAI Codex через одну команду установки

• Три уровня сжатия: Lite, Full и Ultra — под разные задачи

• Научное исследование марта 2026 года подтвердило, что краткость ответов повышает точность моделей на 26 п.п.

Статья полностью: https://tproger.ru/articles/caveman–plagin-dlya-claude-code–kotoryj-ekonomit-75–tokenov-che

GitHub: https://github.com/juliusbrussee/caveman

Caveman: плагин Claude Code, который экономит 75% токенов | Сетка — социальная сеть от hh.ru