Ищу роль SRE/DevOps Middle+ (удалённо) там, где процессы важнее разовых решений: важна воспроизводимость, прозрачность и снижение зависимости от отдельных людей. Мой подход — делать надёжность и затраты измеримыми: внедряю SRE‑практики (SLI/SLO, error budget) и FinOps‑метрики, чтобы команда могла приоритизировать улучшения по реальному влиянию на бизнес. Это снижает риски внеплановых трат и инцидентов в пиковые периоды. Стек и практики: K8s‑эксплуатация и GitOps: K8s (диагностика, лимиты, OOM), ArgoCD, манифесты, Git как источник истины. Автоматизация: Ansible, CI/CD, скрипты на Python/Bash для проверок, валидаций и интеграции мониторинга. Наблюдаемость: Prometheus, Grafana, ELK; Golden Signals, RED/USE, алертинг, который помогает, а не мешает. Процессы надёжности: RCA, PostMortem, runbook, OnCall, blameless‑подход, подготовка к высоким сезонам. Linux и сеть: глубокая диагностика, понимание этапов загрузки ОС, сетевые протоколы и утилиты. По БД: не администрирую кластеры и патчинг, но встраиваю компоненты (Patroni, pgBouncer) как часть платформы и добавляю их в наблюдаемость и CI/CD‑контур.
SRE/DevOps
· 17.08резюме
0 комментов