← К каталогу
МЯ

Мячков Эдуард Евгеньевич

DevOps Engineer/SRE

УдалённоУровень не указанМосква, Россия1 ч назад
Компенсация250 000–300 000 RUR
О ВАКАНСИИ

Описание вакансии

Веду подбор ведущего DevOps-инженера для компании под NDA. Компания развивает инфраструктуру цифровых сервисов для финансовых и телекоммуникационных проектов, платформ обработки данных, ML/LLM-сервисов и корпоративных систем. Кандидат будет отвечать за промышленную эксплуатацию, автоматизацию поставки изменений и надёжность сервисов.

Обязанности:

  • Проектировать и развивать инфраструктуру в облаках и on-premise, поддерживать self-hosted сервисы, физические серверы, виртуальные машины и отказоустойчивые распределённые системы.
  • Администрировать Linux и Windows Server, эксплуатировать Kubernetes и контейнерные приложения: развёртывание, обновление, Helm-чарты, диагностика и масштабирование.
  • Создавать и поддерживать CI/CD-пайплайны: сборка, тестирование, доставка артефактов, развёртывание и откат. Развивать GitOps, применять blue-green и canary-релизы.
  • Описывать инфраструктуру как код, автоматизировать конфигурацию и регламентные операции, писать скрипты и внутренние инструменты, сокращать объём ручной работы.
  • Настраивать мониторинг, алерты, дашборды, централизованный сбор логов и распределённую трассировку; повышать качество сигналов и снижать шум алертов.
  • Определять и контролировать SLI, SLO, SLA и error budget. Измерять доступность, задержки, нагрузку, время восстановления и результаты изменений.
  • Диагностировать production-инциденты, восстанавливать сервисы, проводить RCA и postmortem, устранять первопричины и предотвращать повторные аварии.
  • Оптимизировать производительность и стоимость инфраструктуры, выполнять профилирование, capacity planning и планирование масштабирования.
  • Настраивать сети, маршрутизацию, DNS, TLS, балансировку, Ingress, VPN и Service Mesh; диагностировать прохождение трафика.
  • Сопровождать базы данных, кэши, очереди и платформы данных: репликация, отказоустойчивость, настройка производительности и устранение сбоев.
  • Организовывать backup/restore и disaster recovery, регулярно проверять восстановление и достижение…

Здесь показан очищенный фрагмент описания из источника. Полные условия и актуальность вакансии проверьте на странице работодателя.

ИсточникHeadHunter / DevOps / RU