Временное решение, которое пережило всех своих авторов
Когда я пришёл на текущую работу, предыдущий DevOps/сисадмин уже собирался уходить.
Мы успели поработать вместе всего три дня. У человека накопилось много переработок, он ушёл в отпуск, а потом и вовсе уволился.
А мы с коллегой Сашей остались разбираться в инфраструктуре.
И тут началось самое интересное.
Нужно было искать доступы, выяснять, где и что развёрнуто, находить забытые конфиги, разбираться в сервисах, в которые требовалось внести изменения.
Часть вещей обнаруживалась по ходу работы. Что-то приходилось искать по остаткам документации, конфигам и доступным серверам. Постепенно распутывали этот клубок и пытались понять, как всё устроено и почему работает именно так.
В какой-то момент понимаешь, что инфраструктура это не только серверы, сервисы и конфиги. Это ещё и знания о том, как всё между собой связано. И если эти знания нигде не зафиксированы, их приходится восстанавливать практически с нуля.
Один из таких случаев был с прокси. Я искал, где у него прописана конфигурация, и в итоге выяснилось, что ip_forward когда-то включили прямо через командную строку.
Настройка работала, поэтому никто особенно не задумывался о том, где она должна храниться постоянно.
После перезагрузки виртуалки у хостера значение вернулось к тому, что было прописано в sysctl.conf. Пересылка пакетов между интерфейсами отключилась, и прокси перестал работать как ожидалось.
Вроде мелочь: один параметр Linux. Но пока не найдёшь причину, можно долго искать проблему совсем не там.
В итоге мы постепенно во всём разбирались. Но этот опыт заставил меня задуматься о том, насколько много может зависеть от одного человека.