DevOps-инженер в команду ML-сервисов Yandex Cloud.

Работа не стоит на месте, и прямо сейчас в Питерском офисе (и справедливости надо добавить, не только в нем) команда ML делает продукты, которые упрощают использование машинного обучения и большие языковые модели даже людям, далёким от программирования. Коллеги ищут людей, которые помогут развивать наши продукты и решать возникающие проблемы (куда ж без них), людей, для которых наши сервисы станут своими.

Какие задачи вас ждут:

Поддерживать и развивать инфраструктуру наших сервисов. Вам предстоит автоматизировать текущие и формировать новые инфраструктурные подходы и практики, выстраивать observability сервисов и помогать продуктовым командам с их внедрением. Вы будете ретроспективно развивать инфраструктуру и поддерживать стабильность сервисов по мере роста количества пользователей, функциональности и нагрузки. Пример такой задачи — автоматизация развёртывания ML-моделей.

Исследовать отказы и устранять их причины. Вы будете наблюдать за работой высоконагруженных сервисов и устранять неполадки. Пример такой задачи — анализ роста количества отказов или времени ответа сервиса YandexGPT.

Разрабатывать новые сервисы по мере необходимости. Нужно будет заниматься разработкой — например, создать универсальный прокси-сервер для запуска внутренних сервисов в Yandex Cloud с минимальными усилиями.

А в анамнезе у вас: Go или Java, и вы готовы писать и на том, и на другом. А также вы испытываете непреодолимое желание всё починить, измерить и усовершенствовать. Ну и Terraform, Kubernetes и Envoy не пустые для вас слова.

Другие подробности тут

#вакансия

DevOps-инженер в команду ML-сервисов Yandex Cloud | Сетка — социальная сеть от hh.ru