← К каталогу
ББ

ББР Банк

DevOps/MLOps инженер AI-платформы (LLM/VLM, GPU, RAG)

УдалённоУровень не указанМосква, Россия9 дн. назад
О ВАКАНСИИ

Описание вакансии

Мы развиваем AI-платформу, где LLM/VLM, RAG-пайплайны и транскрибация должны работать стабильно и быстро. Ищем инженера, который возьмет на себя инфраструктуру: подготовит серверный, контейнерный и GPU-контур, настроит CI/CD, мониторинг, хранение и обеспечит поддержку после запуска. Нужно будет поднять и стабилизировать инфраструктуру под AI-нагрузки: GPU, LLM/VLM, транскрибацию.

Чем предстоит заниматься:

  • Инфраструктура для AI: подготовка и сопровождение серверного и контейнерного контура для AI-приложений, GPU-контура для LLM/VLM и отдельного сервера транскрибации. Настройка Docker/контейнеризации, переменных окружения и конфигураций.
  • CI/CD и автоматизация: настройка CI/CD для backend, frontend и служебных компонентов проекта, автоматизация на Python/Bash, использование Docker multi-stage builds.
  • Мониторинг и производительность: настройка мониторинга, журналирования и метрик загрузки (Prometheus, Grafana, Loki, OpenTelemetry), проведение нагрузочных проверок, анализ CPU/GPU/RAM и оптимизация окружения.
  • Хранение и данные: настройка хранилища, резервного копирования, разделение горячих индексов и архива.
  • Эксплуатация и стабильность: поддержка развертываний сервисов, моделей ИИ и конфигураций; стабилизация окружения перед запуском, обработка инфраструктурных дефектов и инцидентов, обновление конфигураций и контроль доступности сервисов. Подготовка эксплуатационной документации, регламентов поддержки и рекомендаций по промышленному масштабированию.

Наш стек:

Python, Bash, Docker (multi-stage), CI/CD, Prometheus, Grafana, Loki, OpenTelemetry, LLM/VLM-инференс, vLLM, LangChain, RAG, vector databases, GPU/NVIDIA, системы транскрибации.

Что для нас важно:

  • Высшее техническое образование, опыт DevOps от 3 до 5+ лет и успешные кейсы подготовки и сопровождения инфраструктуры, связанной с ИИ.
  • Уверенное владение Python/Bash для автоматизации, Docker multi-stage builds, CI/CD, знание Prometheus, Grafana, Loki, OpenTelemetry.
  • Понимание…

Здесь показан очищенный фрагмент описания из источника. Полные условия и актуальность вакансии проверьте на странице работодателя.

ИсточникHeadHunter / DevOps / RU