← К каталогу
СБ

СБЕР

Инженер третьей линии технической поддержки (Sber AntiFraud Platform)

ОфисУровень не указанМосква, Россия3 ч назад
СИГНАЛ JOBRADAR75/100Нормальный сигнал актуальности
ПАСПОРТ ВАКАНСИИ

Что JobRadar наблюдает сейчас

Балл строится только на фактах из источников: свежести подтверждения, возрасте записи и происхождении вакансии. Это не гарантия найма и не оценка работодателя.

Последнее подтверждениетолько что
Впервые замечена3 ч назад
Активные источники1 источник
ПроисхождениеПубличный источник
О ВАКАНСИИ

Описание вакансии

Мы поддерживаем высоконагруженную банковскую систему класса критичности Mission Critical+ (МС+). Это максимальный класс: система работает круглосуточно, и любой сбой сразу замечают клиенты банка.

Третья линия — последний рубеж перед разработкой. К нам приходят инциденты, которые не решились ранее, а от нас уходят задачи, после которых эти инциденты не повторяются. Мы ищем инженера, которому мало просто потушить пожар: важно понять, почему он начался, и сделать так, чтобы он не случился снова.

Обязанности

  • Разбирать инциденты, эскалированные от бизнес пользователей, системы мониторинга и дежурной смены: не только сбои, но и деградацию производительности под нагрузкой. Находить причину по логам, метрикам, трассировкам и данным в БД.
  • Вести управление критичными инцидентами (процесс управления инцидентами): собирать нужных людей, координировать работу, держать бизнес и смежные команды в курсе статуса (коммуникационный план). Для системы МС+ счёт идёт на минуты.
  • Готовить справки по итогам инцидентов: хронология, влияние на клиентов и бизнес, первопричина, что уже сделано и что нужно сделать, чтобы инцидент не повторился.
  • Находить дефекты в продуктиве и подтверждать их: шаги воспроизведения, логи, запросы, ожидаемое и фактическое поведение.
  • Ставить задачи на исправление в разработку так, чтобы разработчику не пришлось ничего переспрашивать, и вести их до выката исправления.
  • Искать закономерности и повторяющиеся причины в прошедших инцидентах.
  • Предлагать и доводить до конца меры, которые снижают число инцидентов: исправления, изменения в процессах, автоматизацию.
  • Описывать новые метрики и алерты, если инцидент показал, что мониторинг не заметил проблему или заметил её поздно.
  • Разбирать метрики, которые срабатывают неверно (ложные срабатывания, пропуски, неверные пороги), и добиваться их исправления.

Требования

  • Опыт от 3 лет во второй или третьей линии поддержки, в эксплуатации или SRE.
  • Опыт поддержки высоконагруженных систем, работающих…

Здесь показан очищенный фрагмент описания из источника. Полные условия и актуальность вакансии проверьте на странице работодателя.

ИсточникHeadHunter / Security / RU