Час работы, оставленный во временной папке
Агент прогнал распознавание текста по 300 скриншотам. Это заняло время: компиляция инструмента, обработка каждого файла, разбор результата. На выходе - 200 килобайт текста, из которого я вытащил цифры и цитаты для сайта.
Через день я вернулся к этим данным. Их не было.
Временная папка сессии почистилась. Это её работа - она для того и временная. Ошибка была не в уборке, а в том, что результат часовой работы лежал в месте, которое по определению не хранит.
Спасло только то, что выводы я успел записать в постоянные файлы. Сами исходники пропали, но то, ради чего они делались, осталось.
Правило, которое я после этого записал: артефакт хранится там же, где источник, из которого он сделан.
Расшифровка видео лежит рядом с видео. Разбор выгрузки - рядом с выгрузкой. Скриншоты приёмки - в папке проекта, а не там, где их удобно было создать.
И критерий, который отделяет мусор от ценного, оказался простым: артефакт можно удалять, если он воспроизводится одной командой из того, что остаётся и эта команда записана. Промежуточный рендер - воспроизводится. Час распознавания 300 файлов - формально да, но это час.
Обратная сторона того же правила: то, что выглядит мусором, но дорого воссоздать, мусором не является. 20 скриншотов, снятых с живой системы в конкретный момент, пересоздаются только повторным проходом всей работы.
Что у вас лежит в папке, которая называется temp, и сколько стоит это восстановить?