Воркфлоу валился ровно раз в сутки. Не n8n

Месяц бились с платформой. Воркфлоу для 21 магазина крупного маркетплейса каждый день ложился примерно в одно время, как часы. Первая догадка - проблема в самом n8n, запустили диагностику, добавили логирование. Сам n8n работал без нареканий.

Потом включил SSH в n8n и подключился на машину прямо из платформы. Диск почти полный. Воркфлоу копил временные файлы в /home/node/.n8n/binaryData/, и никто их не чистил. Раз в сутки какой-то фоновый процесс пытался записать на диск, упирался в ENOSPC (No space left on device) и вся система зависала.

Дальше обнаружилось, что cleanup-скрипт, который должен был это чистить, запускался на ДРУГОЙ машине. Логика была там, инструкции тоже, но исполнялась она совсем не там, где копился мусор.

Фикс: cleanup запустили на той же машине и настроили ротацию файлов. Еще добавил мониторинг свободного места и алерты на 80%.

Урок: когда система ломается как часы в одно время, думай не о коде, а о ресурсах (диск, память, подключения). И всегда проверяй, на какой машине исполняется твой скрипт.

#n8n #автоматизация #диагностика #боевые_грабли #девопс #интеграции