AI inference воркеры на K3s с CNI (Flannel, Calico) показывали p99 latency >12ms при нагрузке 8k RPS, несмотря на idle GPU и зелёные дашборды. tcpdump + perf record -g -a -e skb:kfreeskb выявил массовый drop в nfhookslow из-за conntrack saturation. Ключевая метрика: cat /proc/net/stat/nfconntrack. При nfconntrackcount ≈ nfconntrackmax ядро начинает отбрасывать SYN до входа в приложение. В то же время, hostNetwork обходил весь netfilter path для loopback-трафика, давая стабильный p99 <800µs. Решение: для latency-sensitive inference — только hostNetwork + прямая привязка к CPU через isolcpus. CNI — для всего остального. Подробнее: https://ftops.space/?utm*source=telegram&utm*medium=smm&utm*campaign=ftops&utm*content=host-networking-vs-cni-bridges-dlya