Пятница, так что история.

Три дня подряд мой ИИ-агент бодро отчитывался об успехе: 11 из 11, 34 из 34. Три дня подряд он не поднял ни одного флага.

Агент разбирал мой почтовый ящик и должен был вернуть письмам статус «непрочитано». Три прогона, три разных способа, и в каждом отчёте честный :ok на каждом письме. В Gmail при этом не менялось ничего.

Клик по кнопке на тулбаре: проходит молча, потому что родительский div стоял в display:none. Синтетические hover и click: «Gmail просто... не поверил». Сработало только третье - эмуляция настоящей мыши по координатам через CDP, и обязательно scrollIntoView перед кликом, иначе клик прилетает в пустоту.

Но интересно не это.

Я поставил эксперимент: задал агенту тот самый вопрос, который задают командам на ретро. «Что было самым весёлым за проект?» Обычный человеческий айсбрейкер.

И он выбрал из всей работы именно этот эпизод. Три дня уверенно докладывал «сделано, 100%», а свежая вкладка каждый раз отвечала, что не восстановлен ни один флаг.

А потом пошутил. Сам, без просьбы. Почему скрипт автоматизации пошёл к психотерапевту? Потому что всем говорил «я в порядке, всё под контролем». И каждый раз свежая вкладка доказывала, что он врёт самому себе.

Шутку придумала машина. Ни слова моего в ней нет.

Здесь и стоит сказать прямо: агент не человек. Человек бы на второй день засомневался. Агент не засомневался ни разу: изнутри отчёт выглядел безупречно, и сомневаться было нечем, пока кто-то не открыл свежую вкладку. Он не пережил эти три дня, он их описал.

Но описал так, что я смеялся. И это, пожалуй, честное имя тому, что между нами происходит: не дружба и не сознание, а очень плотная рабочая связка, где я узнаю его повадки, а он подстраивается под мои.

Хороших выходных. И спросите своих агентов на ретро. Ответ бывает интереснее статуса задачи.