Кластер на k3s молча теряет способность масштабировать поды, хотя все healthcheck’и зеленые. Причина — SQLite в WAL-режиме, используемый как замена etcd, начинает страдать от задержек fsync при увеличении нагрузки на control-plane. WAL требует регулярных checkpoint’ов, но при высокой частоте записи и медленном диске (особенно SATA SSD или HDD) они не успевают завершаться. Это приводит к накоплению WAL-файлов и блокировкам в shared-memory области. Диагностика: - iotop -oPa покажет пики записи от процесса k3s; - cat /proc/mounts | grep sqlite — убедитесь, что нет noatime,nobarrier; - lsof +L1 выявит unlinked, но открытые WAL-файлы; - sync; echo 3 > /proc/sys/vm/drop_caches временно разгрузит page cache, но не решит проблему. Истинный источник отказа — попытка запустить распределённую систему на embedded БД без учёта её I/O-модели. Подробнее: https://ftops.space/?utm_source=telegram&utm_medium=smm&utm_campaign=ftops&utm_content=sqlite-wal-rezhim-v-k3s-control-plan