← К каталогу
RW

RWB (Wildberries & Russ)

MLOps Engineer (MLE)

УдалённоУровень не указанМосква, Россия7 дн. назад
О ВАКАНСИИ

Описание вакансии

Направление работы:

Мы – направление модерации в отделе Trust & Safety Wildberries, отвечаем за безопасность и модерацию контента и карточек товаров. Ежедневно через наши системы проходят десятки миллионов карточек, это сотни миллионов решений по более чем 100 ML-моделям. Модели инферятся через Nvidia Triton Inference Server, десятки инстансов в нескольких дата-центрах держат пиковую нагрузку порядка 400–500K RPS.

DS-команда растёт, уже 20+ человек только в модерации и 50+ во всём отделе. Сейчас у нас есть серверы с JupyterHub для обучения, ClearML для пайплайнов, Triton для инференса и pgvector для эмбеддингов, но путь модели от эксперимента до прода всё ещё во многом ручной. Нужен инженер, который сделает этот путь автоматизированным и стандартным, чтобы DS обучил модель, прогнал через пайплайн, выкатил в Triton и сразу увидел метрики.

Ищем MLOps-инженера с сильным бэкенд-фундаментом. Твоя зона – сервисный слой платформы. Это пайплайны обучения и деплоя, автоматизация выкатки моделей, сервисы вокруг Triton и SLA инференс-контура. Дальше этот контур масштабируем на все направления Trust & Safety, поэтому строим с прицелом на стандартизацию и переиспользование.

Стань частью команды!

Вам предстоит:

  • Строить и автоматизировать пайплайны обучения в ClearML, от экспериментов DS до воспроизводимого артефакта в model registry;
  • Автоматизировать деплой моделей в Triton, включая конвертацию в ONNX и TensorRT, конфигурацию, выкатку без участия инженера, канареечные релизы и откаты;
  • Развивать Python-сервисы вокруг Triton, единый inference gateway, gRPC, батчинг и очереди;
  • Ускорять инференс через профилирование, dynamic batching, ensemble и BLS, TensorRT-оптимизации;
  • Держать SLA инференс-контура – метрики, алертинг, разбор инцидентов, дежурства в ротации;
  • Поддерживать JupyterHub, ClearML-агенты и шаблоны проектов для DS-команд;
  • Вместе с инфраструктурным инженером проектировать размещение моделей на GPU-кластере;
  • Общаться с DS-командами…

Здесь показан очищенный фрагмент описания из источника. Полные условия и актуальность вакансии проверьте на странице работодателя.

ИсточникHeadHunter / Developers / RU / between3And6