← К каталогу
ПУ

ПУЛЬС АЙТИМ

SRE инженер (1С) / Инженер по надёжности информационных систем (1C)

УдалённоУровень не указанМосква, Россиявчера
О ВАКАНСИИ

Описание вакансии

Мы ищем специалиста, который обеспечит стабильную и предсказуемую работу наших информационных систем на базе 1С и MS SQL. Ваша главная цель — не просто «чинить», а системно повышать надёжность: внедрять метрики, автоматизировать обнаружение проблем, проектировать отказоустойчивость и устранять первопричины сбоев. Роль предполагает выделение до 10 % времени команд на задачи по надёжности и улучшению процессов.

Тебе предстоит:

Управление инцидентами и постмортемы

  • Координировать участников «пожарной команды» для оперативного решения критических инцидентов.
  • Собирать информацию о проблеме, контролировать заведение аварии, фиксировать хронометраж и ключевые действия.
  • Писать постмортем‐отчёты (blameless postmortem): фиксировать, что произошло, как реагировали, какие уроки извлечены.
  • Контролировать и ставить задачи по недопущению повторения причин инцидентов (RCA, action items).

Производительность и доступность

  • Определять и поддерживать SLI/SLO для ключевых сервисов, вести учёт error budget.
  • Настраивать и анализировать ключевые показатели ИС: создавать дашборды, алерты, описывать реакцию на отклонения.
  • Писать инструкции (runbooks) по реакции на отклонения показателей работы от нормы.
  • Анализировать аномалии: рост нагрузки, рост данных, нехарактерные паттерны поведения системы.

Анализ логов и диагностика

  • Анализировать Журнал регистрации (ЖР) и Технологический журнал (ТЖ) на наличие ошибок и узких мест.
  • Сопоставлять данные из разных источников (логи, метрики, трейсы) для точной локализации проблемы.

Масштабирование и отказоустойчивость

  • Участвовать в проектировании и реализации отказоустойчивой архитектуры (кластеризация 1С, Always On для MS SQL, балансировка нагрузки и т. д.).
  • Готовить систему к пиковым нагрузкам: нагрузочное тестирование, планирование ёмкости, проработка сценариев деградации.

Регулярное обслуживание и гигиена данных

  • Выполнять и автоматизировать типовые операции обслуживания: пересчёт итогов, очистка регистров…

Здесь показан очищенный фрагмент описания из источника. Полные условия и актуальность вакансии проверьте на странице работодателя.

ИсточникHeadHunter / System Engineer / RU