В 03:17 по UTC ваш K3s внезапно лег под нагрузкой, хотя CPU и RAM в норме. Traefik по умолчанию применяет retry policy с maxRetries=10 и exponential backoff. Если бэкенд отвечает за 8+ секунд (например, из-за блокировки на NFS или SQLite WAL), Traefik начинает ретраить каждый запрос до 10 раз — параллельно. Результат: сотни тысяч исходящих соединений к одному поду, переполнение net.core.somaxconn, исчерпание диапазона net.ipv4.ip_local_port_range, рост tcp_tw_buckets и полный стоп новых подключений. Проверьте: ss -s netstat -s | grep -i 'listen overflows' cat /proc/net/sockstat Полный разбор с графиками conntrack, accept queue drops и TCP retransmits — https://ftops.space/?utm_source=telegram&utm_medium=smm&utm_campaign=ftops&utm_content=traefik-ingress-retry-storms-kak-de