Воркфлоу валился ровно раз в сутки. Не n8n
Месяц бились с платформой. Воркфлоу для 21 магазина крупного маркетплейса каждый день ложился примерно в одно время, как часы. Первая догадка - проблема в самом n8n, запустили диагностику, добавили логирование. Сам n8n работал без нареканий.
Потом включил SSH в n8n и подключился на машину прямо из платформы. Диск почти полный. Воркфлоу копил временные файлы в /home/node/.n8n/binaryData/, и никто их не чистил. Раз в сутки какой-то фоновый процесс пытался записать на диск, упирался в ENOSPC (No space left on device) и вся система зависала.
Дальше обнаружилось, что cleanup-скрипт, который должен был это чистить, запускался на ДРУГОЙ машине. Логика была там, инструкции тоже, но исполнялась она совсем не там, где копился мусор.
Фикс: cleanup запустили на той же машине и настроили ротацию файлов. Еще добавил мониторинг свободного места и алерты на 80%.
Урок: когда система ломается как часы в одно время, думай не о коде, а о ресурсах (диск, память, подключения). И всегда проверяй, на какой машине исполняется твой скрипт.
#n8n #автоматизация #диагностика #боевые_грабли #девопс #интеграции