← К каталогу
EV

EvoAI

DevOps-инженер (ML/LLM/CV)

УдалённоУровень не указанМосква, Россия14 ч назад
Компенсациядо 220 000 RUR
О ВАКАНСИИ

Описание вакансии

Кто мы?

EVO AI — IT-компания в области AI-консалтинга и генеративного искусственного интеллекта.

Мы разрабатываем и внедряем AI-агентов, ассистентов и комплексные AI-решения для бизнеса , а также развиваем собственную no-code платформу для создания и оркестрации AI-агентов.

Работаем с крупным российским и международным бизнесом.

Чем предстоит заниматься:

1. Инфраструктура и развёртывание

  • Проектировать и настраивать инфраструктуру для ML-сервисов в облаках (AWS / GCP / Azure / Yandex Cloud / VK Cloud и др.).
  • Автоматизировать развёртывание вычислительных ресурсов (GPU/CPU-кластеры, контейнеры, serverless-функции) с помощью Terraform / Ansible / Pulumi.
  • Настраивать контейнеризацию (Docker) и оркестрацию (Kubernetes, Helm, ArgoCD).
  • Создавать CI/CD-пайплайны (GitLab CI/CD, GitHub Actions, Jenkins) для сервисов и моделей.
  • Разрабатывать и сопровождать Helm-чарты и конфигурации для автоматического деплоя.

2. MLOps и сопровождение моделей

  • Организовывать полный жизненный цикл моделей: обучение → упаковка → деплой → мониторинг → переобучение.
  • Настраивать и поддерживать ML-ориентированные хранилища артефактов (DVC, MLflow, W&B).
  • Поддерживать пайплайны подготовки данных и обучения моделей (Airflow, Kubeflow, Prefect).
  • Контролировать версии данных и моделей, управлять Docker-репозиториями (Harbor, ECR, GCR).
  • Настраивать мониторинг качества моделей (drift, latency, ошибки инференса).

3. Сетевое взаимодействие и интеграции

  • Настраивать безопасное взаимодействие сервисов (VPN, bastion-хосты, VPC, private endpoints).
  • Организовывать API-шлюзы, балансировщики, SSL/TLS, OAuth, SSO.
  • Настраивать обмен данными через REST/gRPC/WebSocket и интеграции с Kafka / RabbitMQ.
  • Взаимодействовать с инфраструктурой заказчика при деплое сервисов.

4. Надёжность, масштабируемость и безопасность

  • Настраивать отказоустойчивые и масштабируемые кластеры для LLM и CV-инференса.
  • Внедрять мониторинг, логирование и алертинг (Prometheus…

Здесь показан очищенный фрагмент описания из источника. Полные условия и актуальность вакансии проверьте на странице работодателя.

ИсточникHeadHunter / DevOps / RU