К списку

Ведущий SRE

Lamoda

Москва Инженерия и эксплуатацияИТ

Чем предстоит заниматься:

Повышать надёжность ИТ-сервисов, развивать процессы, повышающие надёжность ИТ-сервисов и инфраструктуры;

Участвовать в разборах инцидентов и проблем, выявлять риски и эксплуатации;

Участвовать в процессе архитектурного ревью ИТ-сервисов и инфраструктуры;

Автоматизировать и внедрять практики SRE;

Контролировать актуальность технической документации.

Мы ожидаем:

Опыт развертывания, администрирования и траблшутинга высоконагруженных систем оркестрации контейнеров, как on-prem, так и в публичных облаках (у нас Kubernetes);

Понимание подхода IaC и управления конфигурациями (у нас Ansible и Terraform) и умение его применять;

Опыт построения систем наблюдаемости, как системных, так и прикладных решений. Понимание, какие метрики собирать, куда смотреть при проблемах, какие дашборды для этого нужны (мы используем Prometheus/Grafana);

Понимание принципов и опыт построения отказоустойчивых сервисов и эксплуатации высоконагруженных систем (Web-серверов, СУБД, приложений);

Опыт построения процесса непрерывного резервного копирования инфраструктурных компонентов.

Опыт разработки на Python/GO.

Источник: job.lamoda.ru (Lamoda) 11 сентября 2026