🤖 Мультиагентная QA-система на Claude Code: как мы автоматизировали тестирование (3/3) #qa #ai #head
Заканчиваем серию постов. Первая часть: *📐 Принципы, которые выработали 1. Полная автономность исполнителей Исполнители никогда не задают вопросов пользователю. Действуют, ошибаются, исправляются — но не останавливаются. Вопросы задаёт только координатор, и только в самом начале. Почему: каждый вопрос — это пауза в минуты или часы. Один вопрос от агента = весь конвейер стоит.
2. Координатор не исполняет Менеджер думает и делегирует. Точка.
3. Тестируй эффект, а не CRUD Недостаточно проверить «создал-прочитал-удалил». Автотест должен проверять бизнес-влияние: после действия X результат Y действительно изменился. Это правило зашито в инструкцию каждого агента — иначе они генерят тривиальные CRUD-тесты и считают что работа сделана.
4. Инкрементальная запись результатов Web Tester работает в браузере — каждый скриншот жрёт контекст. Если копить результаты до конца — контекст закончится раньше. Решение: записывать каждый результат сразу. Даже если агент оборвётся — результаты уже на диске.
5. Автотест — зеркало реальности Если фича сломана (500, ошибка БД) — автотест должен падать, а не обходить проблему мягкими проверками. Починят инфраструктуру — тест начнёт проходить. Это честный сигнал, а не зелёная галочка для самоуспокоения.
🔁 Как повторить у себя 1. Определите агентов — какие роли участвуют в вашем процессе. Кто анализирует? Кто проверяет API? UI? Кто пишет автотесты? Каждая роль — отдельный агент.
2. Напишите инструкции — для каждого агента .claude/agents/{role}.md с алгоритмом, форматом ввода/вывода, обработкой ошибок и примерами. Просто попросите нейронку это сделать.
3. Создайте slash-команду — .claude/commands/qa.md как точку входа.
4. Определите файловый протокол — какие файлы создаёт координатор, какие исполнители, как обмениваются находками.
5. Настройте CLAUDE.md — общие знания: структура проекта, окружения, аутентификация, скрипты.
6. Вынесите рутину в скрипты — .claude/scripts/. Агенты не должны помнить длинные команды. Скрипт — это контракт: вызвал с простыми аргументами, получил результат.
📊 Что получилось Одна команда /qa <ссылка на задачу или описание> запускает: • Анализ задачи и уточнение scope • Параллельное API + UI тестирование • Обмен находками между агентами в реальном времени • Написание и отладку автотеста • Создание тест-кейса в TMS • Обновление базы знаний проекта • Финальный отчёт
Весь цикл — 15-30 минут. Ручного участия — ответить на 1-2 вопроса в начале.
Главный урок: агентная система — это не один умный промпт, а архитектура из специализированных агентов с чёткими контрактами между ними. Файловая система как шина данных, markdown как формат контрактов, slash-команды как точки входа.
Ну и да — агенты косячат. Как и люди. Но в отличие от людей, им можно переписать мозги за 10 минут и перезапустить.
В качестве продолжения попробуем пофантазировать, куда это еще можно прокачать, а тут масса извращенных идей.
Лайк-шер-подписка @readyfortesting
В этом посте были ссылки, но мы их удалили по правилам Сетки*
· 21.04
принцип "координатор не исполняет" - это по сути single responsibility в агентной архитектуре. пробовал похожее на python, и главная проблема была именно в том что "умный" оркестратор начинал сам что-то делать когда исполнитель зависал. потом понял - лучше пусть падает с ошибкой, чем тихо берёт лишнее на себя
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён
· 21.04
Да, такое бывает
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён