согаз

Head of ML Infrastructure & Platform

Хотите стать частью увлекательного процесса цифровой трансформации?

согаз · На сервисе с: 24.09.26 13:45

Зарплата не указанаРоссияМоскваОфис

Хотите стать частью увлекательного процесса цифровой трансформации?

Блок IT в СОГАЗ активно развивается и меняет подход к созданию продуктов. Мы создаем новые сервисы и решения, которые делают нашу работу более технологичной и эффективной.

Сейчас мы в поисках Руководителя инфраструктуры и платформы AI, который , который возьмёт на себя техническую ответственность за AI инфраструктуру компании и AI-платформу: от вычислительной инфраструктуры и размещения моделей до оркестрации, мониторинга и отказоустойчивости.​​​​​​​​​​​​​​​​​​​​​

Задачи:

1. Вычислительная инфраструктура и GPU

  • Развивать инфраструктуру для размещения и эксплуатации AI/ML-моделей во внутреннем контуре
  • Участвовать в планировании вычислительных мощностей и эффективного использования GPU-ресурсов
  • Определять подходы к размещению моделей, управлению ресурсами и масштабированию inference-нагрузки

    2. Модели и ML/LLM-инфраструктура
  • Развивать платформу для деплоя, запуска и эксплуатации моделей
  • Определять подходы к model serving, маршрутизации запросов и оптимизации inference
  • Развивать процессы жизненного цикла моделей, конфигураций и версий
  • Обеспечивать возможность подключения и эксплуатации разных моделей и AI-компонентов

    3. Агентная платформа и оркестрация
  • Развивать платформу, на которой внутренние пользователи создают и запускают AI-агентов
  • Проектировать и развивать runtime и оркестрацию выполнения агентных сценариев
  • Обеспечивать взаимодействие моделей, инструментов, сервисов и корпоративных систем
  • Развивать технические механизмы управления ресурсами, доступами, лимитами и состоянием выполнения
  • Повышать удобство использования платформы для внутренних разработчиков

    4. Техническая стратегия и архитектура AI-платформы
  • Формировать техническое видение и архитектуру платформы развития AI
  • Определять ключевые инженерные приоритеты и технологические стандарты
  • Проектировать платформу с учётом масштабируемости, безопасности, надёжности и эффективности использования ресурсов
  • Принимать архитектурные решения по интеграции AI-компонентов и инфраструктурных сервисов

    5. Надёжность, мониторинг и эксплуатация
  • Выстраивать observability для AI-платформы и её компонентов
  • Определять и контролировать SLO/SLA в пределах зоны ответственности
  • Развивать отказоустойчивость, резервирование и механизмы восстановления
  • Организовывать работу с инцидентами, анализом причин и устранением системных проблем
  • Контролировать производительность, доступность и эксплуатационную зрелость платформы
    ​​​​​​​
    6. Команда и инженерные процессы
  • Руководить командой ML/AI инженеров и развивать её компетенции
  • Участвовать в найме, постановке целей и профессиональном развитии сотрудников
  • Создавать инженерные практики, стандарты и принципы технического проектирования
  • Формировать культуру ответственности за качество, эксплуатацию и результат
  • Взаимодействовать с командами инфраструктуры, информационной безопасности и разработки
Требования:
  • Опыт руководства инженерной командой в области ML Platform, AI Infrastructure, MLOps, Platform Engineering или смежном направлении
  • Значительный опыт разработки и эксплуатации production-систем
  • Глубокое понимание распределённых систем, сетевого взаимодействия, хранения данных и управления ресурсами
  • Практический опыт работы с Kubernetes и контейнерной инфраструктурой
  • Опыт эксплуатации ML/LLM-моделей и понимание архитектуры model serving
  • Понимание особенностей GPU-инфраструктуры, включая память, вычислительную нагрузку, сетевые взаимодействия и ограничения при inference
  • Опыт построения и развития платформ, которыми пользуются другие инженерные команды
  • Способность самостоятельно проводить архитектурный анализ и принимать технические решения
    Будет плюсом:
  • Опыт работы в крупных enterprise-компаниях с повышенными требованиями к безопасности и надёжности
Условия:
  • Заботу компании о вашем здоровье: ДМС со стоматологией в лучших клиниках страны
  • Собственный фитнес-центр в офисе в центре Москвы (новейшее уникальное оборудование Milon для «умных» тренировок)
  • Возможность проходить внешнее обучение после успешного прохождения испытательного срока, а также обучаться на курсах нашего корпоративного портала
  • Премиальные условия на все виды страхования в СОГАЗе для вас и близких родственников
  • Реальные возможности профессионального и карьерного роста
  • Оформление полностью в соответствии с ТК РФ
  • Настрой на долгосрочное сотрудничество: будем гарантом стабильности даже в нестабильные времена
  • Заботу компании о детях сотрудника: скидки в детские лагеря и подарки на Новый год
  • Удобное расположение офиса

Похожие вакансии MLOps инженер

Соц.сети
Н

Senior ML Engineer / MLOps Engineer

Неизвестный работодательНа сервисе с: 24.09.26 16:26
Зарплата не указанаПольшаУдалёнка

#вакансия #vacancy
🚀 Senior ML Engineer / MLOps Engineer — 100% Remote
Must-have:
• Strong Python
• AWS / SageMaker
• MLOps, CI/CD
• Docker + Kubernetes
• ML lifecycle tools: MLflow / Kubeflow / SageMaker Pipelines
• Production experience with ML & LLM applications
• Generative AI / LLMOps
• PySpark / Apache Spark
• FastAPI / Flask
• Model training, fine-tuning, evaluation & optimization
📍 100% Remote | 🇬🇧 English B2+
📅 Duration: 3 months + extension
💰 Rate: TBD
⏰ Full-time
📩 Для подачи присылайте CV в telegram: ••••••••

Соц.сети
Т

Middle ML

телекомНа сервисе с: 24.09.26 15:57
Зарплата не указанаРоссияУдалёнка

ID 3661 - Middle ML

🌍 Локация: РФ
💼 Удаленно
🕔 Занятость: фуллтайм

🏢 Проект: Телеком

💡 Требования:
• ML Engineer, middle 1 Опыт деплоя ML-моделей от 2 лет
• Опыт с очередями, написание прод кода для агентов
• Знание Docker, k8s, CI/CD. Опыт MLOps: мониторинг моделей, ре-тренинг
• Успешное прохождение очного интервью с решением задач на применнеие Python и SQL на темы: развёртывание агента в k8s; публикация скиллов; публикация Tool на MCP; настройка коммуникации агентов через A2A; использование LLM; настройка мониторинга, алертов

➕Будет плюсом:
• Понимание AgentOps

📨 Отклик — через форму: ••••••••
или напрямую рекрутеру ••••••••

❗️Откликайтесь только при релевантном опыте.

❗️При первичном отклике:
ID вакансии / ФИО / локация / возраст / занятость (работаете/нет) / формат работы (удаленка, гибрид, офис) / стек / опыт / резюме / сверка с требованиями

❗️Повторный отклик: ID вакансии + сверка.

#ML #Удаленно #вакансия

Соц.сети
Н

ML Engineer / MLOps (Middle)

Неизвестный работодательНа сервисе с: 24.09.26 14:56
Зарплата не указанаРоссияУдалёнка

ID 3661
ML
Middle
РФ
Телеком

Кол-во специалистов: 1
Формат: удаленный
Продолжительность: до конца 2027

✅ Требования:

• ML Engineer, middle 1 Опыт деплоя ML-моделей от 2 лет
• Опыт с очередями, написание прод кода для агентов
• Знание Docker, k8s, CI/CD. Опыт MLOps: мониторинг моделей, ре-тренинг
• Успешное прохождение очного интервью с решением задач на применнеие Python и SQL на темы: развёртывание агента в k8s; публикация скиллов; публикация Tool на MCP; настройка коммуникации агентов через A2A; использование LLM; настройка мониторинга, алертов

➕Будет плюсом:

• Понимание AgentOps

❗️❗️❗️Пишите ••••••••⚡️⚡️⚡️⚡️, прикладывая резюме, в котором указан возраст и местонахождение. Укажите 🆔 вакансии! Без этой информации заявки не будут рассматриваться! ❗️❗️

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.