снэп айти

AI-First ML / MLOps Engineer (Python)

SNAP IT - российская независимая технологическая компания.

снэп айти На сервисе с: 07.10.26 11:21

150k–200k ₽РоссияМоскваУдалёнка

SNAP IT - российская независимая технологическая компания.

Мы представители самой технологичной и стремительно эволюционирующей индустрии IT. Создаем ПО для ФинТеха.
Топовые банки уже доверили нам самые сложные высокотехнологичные проекты.
Мы верим, что роботизация бизнеса - это будущее, которое наступило уже сегодня.

Ищем инженера, который совмещает прикладную ML-разработку и MLOps: умеет работать с данными и моделями, организовать воспроизводимый процесс и довести решение до стабильной работы в production с помощью ИИ-агентов.

Обязанности:

  • Вести ML-задачу. Уточнять задачу и критерии успеха, анализировать и подготавливать данные, создавать baseline и выбирать подход.
  • Обучать и оценивать модели. Обучать или дообучать модели, анализировать ошибки, сравнивать решения по качеству, скорости и стоимости. Документировать результаты экспериментов и ограничения выбранного подхода
  • Организовывать воспроизводимый MLOps-процесс. Автоматизировать подготовку данных, обучение, оценку и развёртывание; версионировать данные, код, модели и конфигурации. Обеспечивать повторяемость экспериментов и сборок
  • Разрабатывать и сопровождать ML-сервисы. Создавать сервисы инференса и интеграции с продуктом, настраивать окружения CPU/GPU, тестирование, CI/CD, мониторинг, обновление и откат моделей
  • Настраивать ИИ-агентов для ML и инфраструктуры. Создавать skills, проектные инструкции и workflow. Подключать инструменты и документацию, контролировать доступ к данным, секретам и вычислительным ресурсам, проверять подготовленный агентами код
  • Лично валидировать качество. Вручную проверять данные и разметку на выборках, анализировать предсказания и ошибки модели, исследовать проблемные сценарии. Не ограничиваться сводными метриками
  • Проверять решение в целевой среде. Лично проходить реальные сценарии в развёрнутом продукте, проверять интеграции и нагрузочные характеристики. Диагностировать проблемы данных, модели, сервиса и инфраструктуры
  • Контролировать работу после запуска. Следить за качеством, задержками, ошибками, потреблением ресурсов и изменениями входных данных. Исследовать отклонения, устранять проблемы и проверять результат исправлений

Требования:

  • Самостоятельная ML-разработка. Уверенный Python, опыт PyTorch и/или scikit-learn либо аналогичных инструментов. Умение читать, писать и отлаживать код подготовки данных, обучения и инференса, а не только запускать готовые примеры

  • Production-опыт и MLOps. Практический опыт развёртывания и сопровождения ML-сервисов. Понимание API, хранения и версионирования артефактов, воспроизводимости окружений, мониторинга, обновления и отката моделей

  • Инженерная инфраструктура. Практические навыки Linux, Docker, Git, тестирования и CI/CD. Умение диагностировать проблемы производительности, использования CPU/GPU и памяти

  • Coding agents и их адаптация. Практический опыт Codex, Claude Code или аналогов; создание skills и проектных инструкций, настройка контекста, инструментов и безопасных окружений под ML- и инфраструктурные задачи

  • Личная ответственность за результат. Готовность самостоятельно проверять код и выводы агентов, вручную анализировать данные и предсказания, проверять реальные сценарии и доводить модель и сервис до согласованного качества

Будет плюсом:

  • Опыт MLflow, DVC, Kubernetes и оркестраторов вычислительных задач

  • Опыт оптимизации GPU-инференса, батчинга, квантования и нагрузочного тестирования ML-сервисов

  • Хорошее понимание ASR, TTS, DSP ML, speech & audio processing понимание трансформеров, attention-механизмов, KV-cache, diffusion

  • Опыт работы с диффузионными и авторегрессионными архитектурами для аудио/музыки

Условия:

  • Формат работы: удалённый. Важно иметь возможность пару раз в месяц ездить в офис в Москве;

  • Оформление в соответствии с ТК РФ;

  • ДМС+стоматология после окончания испытательного срока;

  • Предоставление техники;

  • Отсутствие бюрократии, прозрачность, быстрое принятие решений, а также уважение к каждому члену команды;

  • Поддержка в значимых событиях.

Похожие вакансии MLOps инженер

Соц.сети
мтс
до 250k ₽РоссияУдалёнка

#vacancy

MLOps Engineer (LLM / Multi-Agent Systems / Kubernetes / RAG) ⚡️🤖

ID вакансии: MLm_DNA

Ставка: до 250 000 руб. на руки в месяц.

Грейд: Middle+ / Senior.

Загрузка: Full-time.

Формат: Удалённо.

Локация/Гражданство: РФ.

🏢 Клиент: МТС.

🧩 О проекте: построение и развитие современных MLOps-платформ для машинного обучения с фокусом на LLM-решения, RAG-пайплайны и мультиагентные системы.

Ищем MLOps-инженера, который находится на стыке классического DevOps и передовых AI-технологий. Роль для специалиста, который не только умеет строить надежные CI/CD и оркестрировать пайплайны в Kubernetes, но и глубоко понимает специфику развертывания и обслуживания LLM, LangGraph и Multi-Agent систем.

🚀 Ключевые задачи:

— Построение, развитие и поддержка MLOps-платформ для машинного обучения. — Оркестрация ML-пайплайнов и процессов обработки данных (Apache Airflow). — Внедрение и поддержка инструментов трекинга экспериментов, версионирования данных и моделей (MLflow, ClearML, Kubeflow, DVC). — Настройка и поддержка CI/CD процессов специально для ML-моделей и сервисов. — Инфраструктурная поддержка разработки и развертывания Multi-Agent Systems, RAG-пайплайнов и LLM-приложений. — Настройка мониторинга и наблюдаемости (Observability) для ML-сервисов и LLM-инференса.

🎯 Обязательные требования (Hard Skills):

MLOps и DevOps (КРИТИЧНО!): — Глубокое понимание и опыт работы с Docker и Kubernetes (K8s). — Опыт построения CI/CD for ML (специфичные пайплайны для обучения и деплоя моделей). — Владение инструментами MLOps: MLflow, ClearML, Kubeflow, DVC.

LLM и Agentic AI (КРИТИЧНО!): — Понимание и опыт работы с фреймворками: LangChain, LangGraph, LlamaIndex. — Опыт поддержки инфраструктуры для Multi-Agent Systems и Autonomous Agents. — Понимание принципов RAG (Retrieval-Augmented Generation), MCP (Model Context Protocol), Prompt Engineering и Tool Use. — Опыт работы с API LLM-провайдеров (OpenAI и аналоги).

Оркестрация и наблюдаемость: — Уверенный опыт работы с Apache Airflow. — Опыт настройки мониторинга и наблюдаемости (Observability) для ML-систем (метрики качества моделей, дрейф данных, latency, throughput).

💡 Будет плюсом: — Опыт оптимизации инференса LLM (vLLM, TensorRT-LLM, Ollama). — Знание Python на уровне, достаточном для написания скриптов автоматизации и кастомных операторов Airflow. — Понимание векторных баз данных (Qdrant, Milvus, pgvector) и их эксплуатации.

📲 Контакт для отклика: @hrwomenpro (При отклике, пожалуйста, пишите ID вакансии: MLm_DNA)

hh.ru
Зарплата не указанаРоссияМоскваУдалёнка
Ищем инженера, который совмещает прикладную ML-разработку и MLOps: умеет работать с данными и моделями, организовать воспроизводимый процесс и довести решение до стабильной работы в production с помощью ИИ-агентов.

Ответственность end-to-end: от постановки ML-задачи и выбора подхода до работающего сервиса и контроля качества после запуска. Нужен специалист, способный не только развернуть готовую модель, но и подготовить данные, обучить или адаптировать модель, оценить результат и лично проверить его в продукте.

Обязанности:
  • Вести ML-задачу полного цикла. Уточнять задачу и критерии успеха, анализировать и подготавливать данные, создавать baseline и выбирать подход. Определять, достаточно ли готовой модели или требуется её адаптация либо обучение.
  • Обучать и оценивать модели. Обучать или дообучать модели, анализировать ошибки, сравнивать решения по качеству, скорости и стоимости. Документировать результаты экспериментов и ограничения выбранного подхода.
  • Организовывать воспроизводимый MLOps-процесс. Автоматизировать подготовку данных, обучение, оценку и развёртывание; версионировать данные, код, модели и конфигурации. Обеспечивать повторяемость экспериментов и сборок.
  • Разрабатывать и сопровождать ML-сервисы. Создавать сервисы инференса и интеграции с продуктом, настраивать окружения CPU/GPU, тестирование, CI/CD, мониторинг, обновление и откат моделей.
  • Настраивать ИИ-агентов для ML и инфраструктуры. Создавать skills, проектные инструкции и workflow. Подключать инструменты и документацию, контролировать доступ к данным, секретам и вычислительным ресурсам, проверять подготовленный агентами код.
  • Лично валидировать качество. Вручную проверять данные и разметку на выборках, анализировать предсказания и ошибки модели, исследовать проблемные сценарии. Не ограничиваться сводными метриками.
  • Проверять решение в целевой среде. Лично проходить реальные сценарии в развёрнутом продукте, проверять интеграции и нагрузочные характеристики. Диагностировать проблемы данных, модели, сервиса и инфраструктуры.
  • Контролировать работу после запуска. Следить за качеством, задержками, ошибками, потреблением ресурсов и изменениями входных данных. Исследовать отклонения, устранять проблемы и проверять результат исправлений.
Требования:
  • Практический опыт прикладного ML. Самостоятельная подготовка данных, обучение и оценка моделей, анализ ошибок. Понимание выбора метрик, разделения данных на обучающие, валидационные и тестовые выборки, переобучения и утечек данных.
  • Самостоятельная ML-разработка. Уверенный Python, опыт PyTorch и/или scikit-learn либо аналогичных инструментов. Умение читать, писать и отлаживать код подготовки данных, обучения и инференса, а не только запускать готовые примеры.
  • Production-опыт и MLOps. Практический опыт развёртывания и сопровождения ML-сервисов. Понимание API, хранения и версионирования артефактов, воспроизводимости окружений, мониторинга, обновления и отката моделей.
  • Инженерная инфраструктура. Практические навыки Linux, Docker, Git, тестирования и CI/CD. Умение диагностировать проблемы производительности, использования CPU/GPU и памяти.
  • Coding agents и их адаптация. Практический опыт Codex, Claude Code или аналогов; создание skills и проектных инструкций, настройка контекста, инструментов и безопасных окружений под ML- и инфраструктурные задачи.
  • Личная ответственность за результат. Готовность самостоятельно проверять код и выводы агентов, вручную анализировать данные и предсказания, проверять реальные сценарии и доводить модель и сервис до согласованного качества.

Будет плюсом:

  • Опыт MLflow, DVC, Kubernetes и оркестраторов вычислительных задач.
  • Опыт оптимизации GPU-инференса, батчинга, квантования и нагрузочного тестирования ML-сервисов.
  • Опыт в одном или нескольких направлениях: NLP/LLM, компьютерное зрение, обработка речи или ML на табличных данных.

Что считается завершённой работой:

  • Получено воспроизводимое решение с подтверждённым качеством, проверенное в целевой среде и интегрированное в продукт. Результаты оценки и известные ограничения зафиксированы, мониторинг, обновление и откат предусмотрены.​​​​​​​​​​​​​​ ​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​Личный анализ данных и предсказаний, а также проверка реальных сценариев обязательны. Одной сводной метрики, обученной модели или работающего endpoint недостаточно.

Условия:

  • Фиксированная оплата труда. Уровень дохода в оффере будет согласовываться по грейдовой системе, исходя из результатов собеседования.
  • Готовы рассматривать кандидатов с разным уровнем квалификации (junior/middle/senior).
  • Оформление через ИП.
Соц.сети
мтс

Middle+ / Senior MLOps Engineer

мтсНа сервисе с: 09.10.26 15:48
Зарплата не указанаРоссияУдалёнка

Middle+ / Senior MLOps Engineer в МТС Актуально до 12.10.26
#Middle+ #Senior #MLOpsEngineer #РФ #Удаленно

Требования:
Критично: MLOps, DevOps; Docker, Kubernetes (K8s). CI/CD для ML (пайплайны обучения и деплоя). Инструменты MLOps: MLflow, ClearML, Kubeflow, DVC. LLM и Agentic AI (критично). Понимание и опыт с фреймворками: LangChain, LangGraph, LlamaIndex; поддержка Multi-Agent и Autonomous Agents. Знание RAG, MCP, Prompt Engineering, Tool Use; работа с API LLM‐провайдеров (OpenAI и аналоги). Оркестрация и наблюдаемость: Apache Airflow; мониторинг ML‐систем (качество моделей, дрейф данных, latency, throughput). Плюсом: оптимизация инференса LLM (vLLM, TensorRT‐LLM, Ollama). Дополнительно: Python для автоматизации и кастомных операторов Airflow; векторные БД (Qdrant, Milvus, pgvector) и их эксплуатации.

Локация:📍Удалённо, РФ. Гр: РФ. Full-time.

Контакт для отклика: •••••••• +CV акцент:MLOps пл.,Kubernetes, LLM/Agentic AI (LangGraph, RAG).ID вак:MLm_DNA

••••••••

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.