DevOps-инженер, 4 года. Москва, удалёнка. Пришёл в DevOps не из разработки, а снизу: начинал системным и сетевым администратором в закрытом контуре. VLAN, ACL, Windows Server, Hyper-V, бэкапы. Первое, что сделал на той работе, составил схему сети, потому что документации не было вообще. Локализация проблем сократилась с нескольких часов до десяти минут. Из-за этого я до сих пор смотрю на кластер не как на магию, а как на железо: ноды, диски, сеть, маршруты. Когда под не поднимается, я не гадаю, а иду смотреть, что под оркестрацией. Чем занимаюсь сейчас: CI/CD в GitLab CI. Мой любимый вид работы, убирать копипасту. В прошлой команде один и тот же .gitlab-ci.yml был скопирован в каждый репозиторий. Вынес общую часть в шаблоны и переиспользуемые джобы, подключил около 25 сервисов. Заведение CI новому сервису упало с двух дней до двух часов. Миграция в Kubernetes. Перевёл около 20 сервисов с выделенных ВМ в кластер: контейнеризация, единый Helm-чарт, раскатка через ArgoCD. Релиз стал занимать 15 минут вместо 4 часов ручной работы, откат 2 минуты вместо часа, ночные окна отменили. Эксплуатация. Три кластера (prod в двух ЦОД, stage, dev), около 40 нод в проде, в моей зоне 25 30 сервисов двух команд. Namespace и RBAC под команды, ResourceQuota и LimitRange, NetworkPolicy по требованиям ИБ. Отдельно возился с пробами, PodDisruptionBudget, anti-affinity и HPA, после чего деплой перестал давать всплески 5xx. Облако. Yandex Cloud, ресурсы в Terraform. Доступы по принципу zero trust: сервисные аккаунты с минимальными правами вместо общих ключей, никакого доверия внутренней сети по умолчанию. Мониторинг. Не верю в единый инструмент на всё. На виртуалках Zabbix, в Kubernetes Prometheus и Grafana, логи в Loki. Много времени трачу на чистку шумных алертов, потому что 200 уведомлений в день это то же самое, что ноль уведомлений. Ещё одна вещь, которую считаю важной. Дежурю on-call, участвую в разборе инцидентов и пишу постмортемы. Считаю нормальной культуру, где после аварии ищут причину, а не виноватого, и где на каждый алерт есть runbook, чтобы дежурный в три ночи не думал, а действовал. Стек: GitLab CI, ArgoCD, Kubernetes, Helm, Docker, Trivy, Nexus, Yandex Cloud, Terraform, Ansible, Prometheus, Grafana, Alertmanager, Zabbix, Loki, Velero, PostgreSQL, Kafka, Linux, Python, Groovy, Bash. Ищу позицию middle DevOps там, где инфраструктуру считают продуктом, а не подсобкой. Открыт к диалогу, отвечаю быстро. Telegram: @ogsooon
резюме
0 комментов