Ночью падает legacy-микросервис под K3s. Дашборды показывают «всплеск RPS» и «высокую CPU». Но на ноде — conntrack full, netstat -s кричит о переполнении tcptimewaitbuckets, а ss -s показывает десятки тысяч соединений в TIMEWAIT. Причина? Traefik ingress с дефолтным middleware retry без ограничения attempts и без backoff. Каждый 504 от медленного бэка порождает новый запрос — и так до исчерпания клиентских портов или conntrack. Диагностика: - cat /proc/net/netstat | grep -i "TW" - ss -s - journalctl -u k3s | grep -i traefik - проверить middleware: kubectl get ingressroute -A -o yaml | grep -A5 -B5 retry Фикс: задать maxAttempts: 2, initialInterval: 100ms, maxInterval: 500ms + circuit breaker через latency-based health check. И да — не используйте retry для stateful операций. https://ftops.space/?utm*source=telegram&utm*medium=smm&utm*campaign=ftops&utm*content=traefik-ingress-retry-storms-kak-de