После более 4 лет работы в IT нахожусь в поиске новых возможностей. Последние годы занимался сопровождением и обеспечением надежности production-систем, мониторингом, расследованием инцидентов и автоматизацией операционных процессов. Работал с: • Linux, Docker, Kubernetes • PostgreSQL, MSSQL, ClickHouse • Grafana, Prometheus, Loki, ELK, Graylog, Jaeger • Kafka / Redpanda • Airflow, n8n • SQL, API, Swagger Помимо поддержки инфраструктуры и сервисов, занимался автоматизацией рутинных задач. Например, с помощью n8n реализовывал автоматические проверки процессов, перезапуск задач по расписанию, уведомления в Telegram и обработку инцидентов без участия человека, что сокращало время реакции и количество ручных действий. Также участвовал в: • анализе и разборе инцидентов; • настройке мониторинга и алертов; • сопровождении Kubernetes-кластеров; • поддержке бизнес-критичных сервисов; • взаимодействии с разработчиками и DevOps-командами; • улучшении внутренних процессов поддержки и эксплуатации. Рассматриваю не только позиции SRE, но и смежные направления: • Site Reliability Engineer (SRE) • Production Support Engineer • Incident Manager • Technical Support Engineer (L2/L3) • Technical Operations Engineer • Monitoring Engineer • Application Support Engineer • DevOps Engineer Открыт к удалённой работе и международным командам. Буду благодарен за рекомендации, контакты рекрутеров и информацию об открытых вакансиях. Удалённо.
SRE
· 7 ч · ред.резюме
0 комментов