М

DevOps/MLOps (Senior, Middle+)

Сроки предоставления резюме: до вечера 24.09

маркировка · На сервисе с: 22.09.26 15:21

Зарплата не указанаРоссияБеларусьУдалёнка

ID 3644
DevOps/MLOps
Senior, Middle+
РФ/РБ❗️❗️❗️
Сроки предоставления резюме: до вечера 24.09

Клиент: Маркировка

Проект:
Сопровождение инфраструктуры для инференса LLM‐моделей, AI‐сервисов, Mcp сервисов, агентов.
Работа с GPU‐инфраструктурой и управление on‐prem GPU‐серверами: настройка драйверов ОС, мониторинг, оптимизация использования ресурсов.
Группа развития сервисов. Команда выстраивает современные CI/CD‐процессы на базе open‐source‐решений, обеспечивает поддержку тестовых окружений, команд разработки и тестирования. Ищем инженера в Devops команду развития ai сервисов. Команда 6 человек, ищут 7го.

Длительность: 1 год +
Занятость: фултайм
Гражданство: РФ, РБ
Рабочий график: по МСК ±2 час.
Формат: удаленка
Плановый срок рассмотрения кандидата: 7 ±3 дн.
Дополнительно: Запрос конфиденциален и запрещен к распространению на внешних каналах.
Собеседование 1 этап на 1,5 часа.
На интервью для выполнения практического задания в live-coding должна быть возможность запустить IDEA (или аналог) и пошарить экран.
При использовании ИИ в прохождении собеседования заказчик оставяляет за собой право закончить собеседование ранее предполагаемого времени.

Обязательно:
по DevOps
Linux: администрирование и диагностика.
Python: скрипты автоматизации и интеграции.
Контейнеризация: сборка и сопровождение образов.
Kubernetes: эксплуатация кластеров и приложений.
Helm: разработка и сопровождение чартов.
GitLab CI/CD: разработка пайплайнов.
Ansible: разработка ролей автоматизации.
HAProxy: балансировка трафика.
Istio: управление трафиком сервисов.
Prometheus и Grafana: мониторинг и алертинг.
Vault: настройка хранения и выдачи секретов.
Keycloak: настройка аутентификации и интеграций сервисов.
Kafka: эксплуатация и диагностика брокера.
по ML
Практический опыт эксплуатации GPU и LLM-инференса.
MLflow: сопровождение учёта экспериментов и реестра моделей.
NVIDIA-драйверы и CUDA: настройка и диагностика.
Запуск GPU-нагрузок в контейнерах и Kubernetes.
Понимание механизмов распределения и совместного использования GPU.
vLLM: развёртывание и оптимизация инференса.
LiteLLM: настройка и сопровождение шлюза.
n8n: разработка и сопровождение сценариев автоматизации.
Модели: версионирование, воспроизводимый деплой и откат.
Мониторинг инференса: метрики GPU и производительности.

Желательно:
Опыт с NVIDIA H100/H200❗️
Практический опыт с DRA, MPS и time-slicing
Опыт настройки и диагностики InfiniBand и RDMA/RoCE.
Сопровождение Nexus, Harbor

Задачи:
Проектирование и развитие архитектуры AI‐систем и сервисов инференса.
Внедрение и настройка GPU‐планировщика для шаринга нагрузки на одном физическом сервере и k8s.
Проектирование и поддержка ML‐пайплайнов.
Организация CI/CD для моделей: версионирование данных, моделей, экспериментов.
Мониторинг production‐моделей и инфраструктуры.
Деплой и оптимизация LLM / inference‐серверов.
Контейнеризация и оркестрация сервисов (Kubernetes, Helm).
Настройка и поддержка CI/CD (GitLab CI).
Настройка мониторинга и observability (Prometheus, Grafana).
Обеспечение выполнения требований информационной безопасности в отношении инфраструктуры.
Важно:
Расписано, чем занимался на каждом проекте
Указаны навыки и программы, которые использовались

❗️Просьба при отправке кандидата указывать сразу:

- Штат/рынок/партнер ( если спец.рыночный, указать "на предоффере"):
- Запланированные отпуска (в ближ. 3 мес):
- Готовность к выходу на проект

❗️❗️❗️Писать ••••••••⚡️⚡️⚡️⚡️ С РЕЗЮМЕ В КОТОРОМ УКАЗАН ВОЗРАСТ И ЛОКАЦИЯ НАХОЖДЕНИЯ. Укажите 🆔 вакансии❗️ Без этой информации отклики не рассматриваются ❗️❗️

Похожие вакансии DevOps

hh.ru
нпп баум

SRE-инженер

нпп баумНа сервисе с: 25.08.26 18:32↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМоскваГибрид

Мы — группа компаний, успешно объединяющая экспертизу в IT, проектировании и строительстве. Одно из наших ключевых направлений — сопровождение и развитие корпоративной IT-инфраструктуры и информационной безопасности внешних заказчиков.

Сейчас мы развиваем SRE направление, поэтому ищем опытного инженера, который будет проектировать отказоустойчивую архитектуру и выстраивать процессы.

Чем предстоит заниматься:

  • Проектировать и развивать observability: метрики, логи, трейсинг
  • Настраивать осмысленный алертинг — без шума, с приоритизацией по реальному влиянию на сервис
  • Участвовать в расследовании инцидентов, искать фундаментальную причину проблемы, а не только устранять симптом
  • Готовить структурированные разборы инцидентов и предлагать системные меры для предотвращения повторений
  • Взаимодействовать с инженерами и командами проектов, помогая выстраивать единый подход к мониторингу и надёжности

Что для нас важно:

  • Опыт в роли SRE от ~3 лет с опытом именно построения observability, а не только его поддержки
  • Уверенный опыт с Prometheus/Grafana, опыт работы с логированием и трейсингом (Loki и Tempo)
  • Опыт работы с docker, kubernetes
  • Опыт самостоятельного расследования инцидентов и написания post-mortem с фокусом на корневые причины
  • Готовность выстраивать процессы там, где их пока нет, без готовых шаблонов
  • Уверенный опыт с Linux системами, понимание принципов отказоустойчивости (репликация, кластеризация, балансировка, failover)

Будет плюсом:

  • Опыт внедрения SLI/SLO и работы с error budget на практике
  • Навыки автоматизации (Ansible, Python/Bash)

Мы предлагаем:

  • Надёжность: официальное оформление в штат по ТК РФ, ИТ-аккредитация, достойный прозрачный доход и премии по итогам работы

  • Гибридный формат: возможность совмещать работу из дома и офиса

  • Комфорт: современный офис рядом с м. Волгоградский проспект/Пролетарская

  • Оснащение: вся необходимая современная техника и компенсация корпоративной мобильной связи

  • Забота о здоровье: ДМС со стоматологией после испытательного срока

  • Корпоративные скидки: подключение к программе Best Benefits со скидками от партнеров с первого рабочего дня

  • Развитие: возможности для профессионального роста, открытая коммуникация и сильная команда экспертов

hh.ru
до 440k ₽РоссияМоскваУдалёнка

Группа компаний Орбита - ведущий разработчик цифровых решений, российская аккредитованная ИТ-компания

Масштабный технологический проект с глубокой экспертизой в цифровизации бизнеса. Ключевые отрасли: государственный сектор, FinTech, HR Tech, коммуникации и медиа, услуги, рынок недвижимости, travel.

Нам доверяют крупнейшие компании РФ, среди них: Т1, ВТБ, Иннотех, Альфа Банк, ОИС и другие.

Более 6 лет мы ведем собственную продуктовую и заказную разработку высокоэффективных цифровых решений.

Ищем Главный эксперт по кибербезопасности (Information Security Engineer / Anti-DDoS & WAF)

Обязанности:
  • Сопровождать и администрировать системы Web Application Firewall (WAF), комплексы защиты от DDoS-атак и специализированные системы защиты от ботов.
  • Настраивать и оптимизировать политики безопасности на WAF, а также оперативно внедрять правила защиты на Anti-DDoS решениях.
  • Проводить глубокий анализ сетевого трафика для выявления аномалий и реагирования на инциденты.
  • Тестировать, пилотировать и внедрять новые продукты и инструменты информационной безопасности.
Требования:
  • Критично: Опыт работы и сопровождения систем защиты от DDoS-атак на уровнях L4 (Arbor, Митигатор, Периметр) и L7.
  • Опыт противодействия DDoS-атакам на уровне приложения и блокировки вредоносной активности ботов.
  • Практический опыт эксплуатации WAF (Imperva, Solidwall, F5 ASM, PTAF, Webmonitorx или аналогичных).
  • Уверенные навыки администрирования ОС семейства Linux.
  • Опыт работы с сетевыми и контейнерными технологиями: Nginx, HAProxy, Docker, Kubernetes.
  • Понимание архитектуры веб-приложений и опыт их защиты от угроз из списка OWASP Top 10.
  • Глубокие знания сетевых технологий: принципы работы и архитектура корпоративных сетей, механизмы работы TCP-стека, протоколы маршрутизации, понимание узких мест инфраструктуры.
  • Базовые навыки автоматизации: написание скриптов на Python или других языках.
  • Опыт работы со стеком мониторинга: Zabbix, PRTG, Grafana.
Условия:
  • Удаленный формат работы по РФ;
  • Белую заработную плату, оформление согласно Трудовому кодексу РФ;
  • Поддержку: IT-отсрочку и консультации HR/юристов;
  • Прозрачные процессы и открытую коммуникацию;
  • Работу на лучшем оборудовании без логирования времени, с фокусом на доверии и результате;
  • Личный бренд: возможность выступать на конференциях, митапах, публикация статей;
  • Бенефиты: ежеквартальное обновление корпоративных скидок;
  • Движ: организация вечеринок оффлайн и онлайн, предоставление мерча, проведение конкурсов и челленджей.

    Откликайтесь, будем рады познакомиться лично!

hh.ru
bi.zone направление разработка

Инженер систем мониторинга

bi.zone направление разработкаНа сервисе с: 24.09.26 19:18
Зарплата не указанаРоссияМоскваУдалёнка

BI.ZONE создает IT-продукты для обеспечения кибербезопасности: от мобильных приложений до сложных платформ, в основе которых лежат методы машинного обучения. Благодаря нашим решениям жизнь десятков миллионов людей становится лучше и безопаснее.

Сейчас в команду мы ищем инженера аналитика систем мониторинга, который будет развивать системы логирования и мониторинга, администрировать Linux и PostgreSQL, автоматизировать инфраструктуру и выстраивать отказоустойчивые масштабируемые решения.

Чем предстоит заниматься:

  • Развитие систем мониторинга и логирования;
  • Внесение изменений и корректировок в системы мониторинга команды, участие в постановке новых сервисов на мониторинг;
  • Участие в поддержке, оптимизации и развитии инфраструктуры компании;
  • Внедрение и настройка стека технологий мониторинга (Prometheus, Zabbix, Grafana) с учётом требований отказоустойчивости и масштабируемости.
  • Внедрение и настройка стека технологий логирования (VictoriaMetrics, ELK/GrayLog, Syslog) с учётом требований отказоустойчивости и масштабируемости.

Что для нас важно:

  • Глубокие знания, опыт эксплуатации и сопровождения операционных систем семейства Linux (Oracle Linux 8, Debian, Ubuntu);
  • Опыт внедрения и сопровождения IT систем;
  • Опыт развертывания, настройки и администрирования инфраструктурных сервисов (Zabbix, Grafana, Prometheus, ELK, VictoriaMetrics);
  • Знание, опыт работы с PostgreSQL;
  • Опыт работы с платформой виртуализации VMware vSphere(ESXi, vCenter Server)
  • Опыт работы с системами автоматизации инфраструктуры и контроля версий(GitLab, Ansible, Docker, Terraform);
  • Soft-skills: коммуникативность, развитый time-management, инициативность, адаптируемость, а также желание профессионально и карьерно развиваться

Что нам также важно, но можем рассмотреть кандидатов и без этого:

  • Опыт настройки CI/CD систем (GitLab CI/CD);
  • Опыт работы с платформой виртуализации VMware vSphere(ESXi, vCenter Server);
  • Опыт работы с системами автоматизации инфраструктуры и контроля версий(GitLab, Ansible, Docker, Terraform).

Мы предлагаем:

Защищенность Все гарантии официального оформления по ТК РФ и преимущества аккредитованной IT-компании


Сообщества Регулярные профессиональные митапы и встречи для обмена опытом. А также сообщества по интересам: спорт, игры, книги, аниме

Гибкий график
Никто не следит, когда сотрудник садится за компьютер, сколько часов проводит в офисе, как часто работает удаленно

Забота о здоровье ДМС со стоматологией c первого месяца работы в компании

Обучение Сертификация, профильные курсы, конференции, митапы, хакатоны, CTF-ы

Свободная атмосфера У нас на «ты», никакого дресс-кода и лишней бюрократии

Самореализация Поддержка креатива и воплощение идей. Можно профессионально расти и развивать личный бренд

Скидки на фитнес, покупки и многое другое

Скидки от BestBenefits, «Фитмост», «СберПрайм+»и других компаний-партнеров для всех сотрудников

Корпоративная жизнь Крутые внутренние мероприятия и участие в спортивных стартах, а еще мерч и подарки

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.