Кластер на k3s с SQLite backend перестал реагировать на изменения: apply зависает, но /healthz зеленый. Мониторинг не видит проблемы — CPU и RAM в норме. Реальность: SQLite в WAL-режиме пишет в .wal-файл, который при нагрузке растёт до сотен МБ. При достижении точки checkpoint’а (по умолчанию 1000 страниц) происходит fsync + переименование wal → db. На ext4 без nobarrier или при высокой нагрузке на диск это вызывает задержки до секунд. Диагностика: - iostat -x 1 → высокий await при низкой util% - cat /proc/sys/vm/dirty_ → завышенные лимиты dirty pages - strace -p $(pgrep k3s) -e sync,fdatasync → паузы в fsync() Решение: либо переход на XFS с logbufs=8,logbsize=256k, либо отключение WAL через --etcd-disable-snapshots (если допустимо). Подробнее: https://ftops.space/?utm_source=telegram&utm_medium=smm&utm_campaign=ftops&utm_content=sqlite-wal-rezhim-v-k3s-control-plan