← К каталогу
ББ

ББР Банк

Инженер по мониторингу ИТ систем

ГибридУровень не указанМосква, Россия12 дн. назад
О ВАКАНСИИ

Описание вакансии

ББР Банк - это средний по размерам российский банк с широким спектром предоставляемых услуг.

Банк занимает достойное место на рынке финансовых услуг благодаря:

  • взвешенной стратегии развития;
  • человеческим и профессиональным качествам своих Работников;
  • постоянству в отношениях с Клиентами;
  • своевременному использованию новых технологий бизнеса.

Основные задачи:

  • Анализ текущего состояния систем мониторинга, логирования и алертинга
  • Разработка стратегической дорожной карты (Roadmap) построения единой системы мониторинга ИТ‐инфраструктуры и приложений на горизонте 1–3 лет.
  • Проектирование архитектуры сбора метрик и логов, включая обеспечение интеграции с существующими системами банка (ITSM, Service Desk).
  • Внедрение и настройка стека технологий мониторинга ( Prometheus , VictoriaMetrics , Grafana , Loki/ELK/GrayLog ) с учётом требований отказоустойчивости и масштабируемости.
  • Настройка системы алертинга ( Alertmanager ): формирование правил, интеграция с корпоративными каналами связи (Банк‐чат) и Service Desk для оперативного реагирования на инциденты.
  • Запуск систем активного мониторинга доступности (healthchecks, синтетические транзакции) для критических банковских сервисов.
  • Участие в разборе инцидентов (Postmortem / RCA) с последующей разработкой предложений по улучшению архитектуры мониторинга.

Требования к кандидату:

  • Наличие высшего технического образования.
  • Опыт профессиональной деятельности от 3 до 5+ лет в роли SRE‐инженера, администратора эксплуатации или DevOps, с фокусом на задачах мониторинга в крупных компаниях.
  • Опыт реализации проектов по развёртыванию систем мониторинга с нуля (greenfield‐проекты) либо по полной миграции с устаревших решений на современные технологические стеки.
  • Владение технологическим стеком: Prometheus; Grafana; Loki/ELK; Kubernetes (k8s); Ansible; Zabbix; PRTG.
  • Участие в дежурствах (on‐call) и разбор инцидентов (Postmortem / RCA), включая способность отделять симптомы проблемы…

Здесь показан очищенный фрагмент описания из источника. Полные условия и актуальность вакансии проверьте на странице работодателя.

ИсточникHeadHunter / DevOps / RU