Вот на одном клиентском проекте я агентом запустил тестирование задачи. ИИ написал краткое ТЗ, критерии приемки, тест-кейсы, запустил браузер, пошел тыкать, собирать логи, смотреть разные разрешения и т.д. При этом у меня не то чтобы совсем нет навыков тестирования, и мне даже знакомо понятие «парадокс пестицида». Но сделать эту работу стоит отдельного времени, труда и т.д. И да, пока что иногда он подтупливает и дает недостоверный результат (очень редко). Но и тестировщики тоже могут ошибаться... И конечно, все должно контролироваться, не тем не менее мне немного не по себе.