Путешествие по развитию своего AI- агента

Полгода назад начал делать локального AI-агента для Windows — назвал Пятница. Не чат-бот, а полноценная платформа: слои разрешений, аудит действий, движок задач, голос, свой чат-интерфейс. Всё крутится на локальных LLM через Ollama — без зависимости от облака. Самый интересный урок случился не в архитектуре, а в разговоре с самой Пятницей. Спросил её: «Опиши свою архитектуру». Она уверенно рассказала про Electron-фронтенд и файл Friday.py как точку входа. Звучало убедительно. Было неправдой — Electron в проекте нет и не было, точка входа — обычный cli.py. Модель не врала специально — она достраивала типичную картину «AI-приложения» из общих знаний, потому что реального доступа к моему коду у неё не было. Оказалось, её слой знаний о себе — это read-only прослойка над собственной документацией, которая специально не индексирует весь проект. Я думал, она «знает себя». А она красиво фантазировала. Чинил патчами: сначала дал ей контекст о реальных подпакетах проекта, потом grounding-контекст, чтобы честно говорила «не уверена» вместо того, чтобы выдумывать. Стало сильно лучше, но это костыль — нормальное решение — сделать так, чтобы слой знаний реально отражал код, а не документацию о коде. Важный момент: весь код и вся логика прогоняются локально, на своей машине. Есть опциональный облачный маршрут для отдельных запросов, но память и документы проекта туда по умолчанию не уходят. Для агента, который видит структуру твоего кода и файловой системы, это не мелочь. Отдельно повозился с голосом — подключил несколько TTS-движков (Qwen-TTS, Chatterbox Multilingual, OmniVoice) с клонированием голоса по референсному аудио. Дальше в планах — довести самостоятельное редактирование кода агентом через управляемый пайплайн с проверками, и превратить Пятницу из личного инструмента в модульную платформу. А вам приходилось ловить своего AI-агента на вранье о себе самом?

Путешествие по развитию своего AI- агента | Сетка — социальная сеть от hh.ru