Ventra
SRE & DevOps Lead / Руководитель группы автоматизации и управления инфраструктуры
Что JobRadar наблюдает сейчас
Балл строится только на фактах из источников: свежести подтверждения, возрасте записи и происхождении вакансии. Это не гарантия найма и не оценка работодателя.
Описание вакансии
Мы в Ventra Go! создаём маркетплейс подработок, где люди находят задания, выполняют их и получают быстрые выплаты. Наш сервис помогает компаниям оперативно закрывать кадровые потребности, а исполнителям — зарабатывать удобным способом. Сейчас мы находимся в поиске SRE / DevOps Lead, который возглавит команду платформенной инженерии, выстроит системный SRE-подход и обеспечит надежность , масштабируемость и наблюдаемость продуктовой платформы Ventra Go! в условиях активного роста бизнеса и развития Data/ML-направлений.
Чем предстоит заниматься:
- Лидировать команду SRE / DevOps инженеров (2–5 человек, подрядчики): постановка целей, 1:1, performance review, найм, онбординг и развитие технических компетенций;
- Формировать и развивать SRE-практики: внедрение SLI / SLO / SLA, управление error budgets, мониторинг сквозных бизнес-процессов (BPO);
- Проектировать и развивать observability-платформу (метрики, логи, трейсинг, алерты, дашборды, плейбуки) для сервисов, инфраструктуры и Data/ML-контуров;
- Организовывать процессы Incident Management: on-call дежурства, координация war-rooms, проведение blameless postmortem, контроль выполнения action items;
- Выявлять и устранять скрытые деградации систем без явных аварий (рост latency, saturation, узкие места емкости);
- Развивать и поддерживать Kubernetes-платформу: кластеры, сетевая связность, RBAC, ingress, autoscaling, secrets management, multi-environment (dev / stage / prod);
- Разрабатывать и развивать Infrastructure as Code и GitOps (Terraform, Helm), внедрять единые platform guardrails и стандарты деплоя для продуктовых команд;
- Выстраивать надежные CI/CD и релизные пайплайны (canary, blue-green, zero-downtime, feature flags) для backend, mobile, frontend и data/ML;
- Обеспечивать стабильную эксплуатацию платформенных решений: Kafka, PostgreSQL, Redis, ClickHouse, OpenSearch, Trino, Spark, Iceberg;
- Проводить capacity planning с учетом роста нагрузки и сезонности, оптимизировать…
Здесь показан очищенный фрагмент описания из источника. Полные условия и актуальность вакансии проверьте на странице работодателя.