сбер. it

DevOps Engineer (AI / LLM / Kubernetes)

сбер. it · На сервисе с: 18.08.26 15:12

Зарплата не указанаРоссияМоскваОфис

Мы строим AI-платформу для юристов (GigaLegal): LLM-агенты, RAG, high-load inference и интеграции с внешними системами.

Ищем DevOps-инженера, который поможет собрать и масштабировать инфраструктуру под реальные прод-нагрузки в разных средах.

  • разворачивание и поддержка Kubernetes

  • работа с GPU-инфраструктурой (A100 / V100)

  • настройка CI/CD (GitOps, Helm, ArgoCD)

  • мониторинг и логирование (Prometheus, Grafana, Loki)

  • обеспечение отказоустойчивости и масштабирования.

  • оконченное высшее образование

  • опыт DevOps / SRE от 3 лет

  • опыт работы с Kubernetes

  • Docker, CI/CD, мониторинг

  • опыт работы и настройки SOWA

  • опыт разработки high-load систем

Будет плюсом:

  • навыки работы с генеративными AI-моделями

  • опыт создания AI-агентов и использования их в работе будет преимуществом

  • работа с ML / LLM / GPU.

  • формат работы офис на испытательном сроке, делее гибрид обсуждаем, локация офиса ул Вавилова д.19

  • ежегодный пересмотр зарплаты, годовая премия

  • корпоративный спортзал и зоны отдыха

  • более 400 образовательных программ СберУниверситета для профессионального и карьерного развития

  • расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа

  • гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ

  • подписка Прайм с возможностью совместного использования на трёх близких

  • вознаграждение за рекомендацию друзей в команду Сбера.

Эта вакансия также есть на:hh.ru

Похожие вакансии DevOps

hh.ru
мттех

DevOps engineer

мттехНа сервисе с: 20.08.26 09:37
Зарплата не указанаРоссияМоскваОфис

МТТЕХ - центр разработки Московского транспорта.
Мы создаём ИТ-решения, которыми ежедневно пользуются миллионы пассажиров: от оплаты и планирования маршрутов до беспилотного трамвая

Что нужно делать (Обязанности):

  • Развивать и поддерживать GitLab CI/CD-пайплайны

  • Обеспечивать стабильную и непрерывную работу сборочного конвейера

  • Запускать и интегрировать в пайплайны тесты, проверки качества кода, SAST и Lint

  • Анализировать производительность CI/CD-процессов, находить узкие места и ускорять пайплайны

  • Настраивать и оптимизировать сборку .deb -пакетов, управлять деревом зависимостей и улучшать процесс доставки зависимостей

  • Работать с Docker: сборка, отладка, оптимизация образов, настройка окружений, поддержка сценариев с GPU

  • Поддерживать и развивать внутренние репозитории артефактов в Nexus

  • Участвовать в релизном цикле: собирать требования к артефактам, помогать согласовывать график релизов, улучшать подходы и процессы релизной подготовки

  • Работать с Linux-инфраструктурой, shell-скриптами и автоматизацией рутинных задач

  • Участвовать в мониторинге состояния инфраструктуры сборки и доставки.Реагировать на инциденты, связанные со сборками, пайплайнами, артефактами и инфраструктурой доставки

  • Участвовать во внедрении базовых мер информационной безопасности

Что важно для нас:

  • Опыт работы DevOps-инженером от 4 лет

  • Уверенные навыки работы с Linux

  • Глубокий практический опыт работы с Docker: сборка, оптимизация, отладка, работа с образами и контейнерными окружениями

  • Хорошее понимание Git и процессов командной разработки

  • Опыт настройки и поддержки GitLab CI/CD

  • Опыт работы с Nexus или аналогичными системами хранения артефактов

  • Опыт сборки и сопровождения Docker-образов

  • Опыт сборки .deb -пакетов и понимание принципов управления зависимостями

  • Опыт работы с системами мониторинга и логирования: VictoriaMetrics / Prometheus, Grafana

  • Понимание основ информационной безопасности и опыт применения практических мер защиты инфраструктуры

  • Готовность разбираться в коде и сборочных процессах проектов на C++, Python и Shell

Будет плюсом

  • Опыт оптимизации больших GitLab CI/CD-пайплайнов
  • Опыт работы с GPU в Docker-контейнерах
  • Опыт настройки внутренних registry и proxy-репозиториев для зависимостей
  • Опыт построения релизного процесса для продуктов с несколькими типами артефактов
  • Опыт внедрения SAST, Lint и других quality gates в CI/CD
  • Опыт анализа проблем сборки C++ и Python-проектов

Работа у нас это:

  • Забота о здоровье без лишней бюрократии (комфортный пакет ДМС)

  • Энергия, которая не заканчивается на дейликах (компенсация спорта)

  • Рабочий день начинается с завтрака за кофе (компенсация питания)

  • Дорога до офиса и обратно без лишних трат (компенсация проезда на пассажирском транспорте)

  • Дополнительные дни для перезагрузки (5 day-off в год)

  • Аккредитованная ИТ-компания

Сайты компаний
сбер. it

SRE / DevOps Engineer (Agentic AI)

сбер. itНа сервисе с: 03.07.26 18:33↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМоскваОфис

Мы команда Департамента Глобальных Рынков Сбера, где создаются системы для трейдинга. Сейчас мы развиваем два high-load направления: сбор и дистрибуцию потоковых маркет-данных, а также расчет позиций и рисков в реальном времени.

Сейчас команда создает AIOps-систему. Мы не просто внедряем мониторинг, мы строим ИИ-агента, который способен автономно наблюдать за сервисами, находить первопричины инцидентов и устранять их. Мы фанаты автоматизации и ищем того, кто разделит этот подход.

Мы ищем SRE-инженера, который готов заниматься задачами на стыке R&D и реальной эксплуатации.

Что ты будешь делать:

  • развивать и сопровождать AI-агента для автоматического обнаружения, диагностики и устранения инцидентов в критичных системах
  • проектировать слой наблюдаемости (метрики, логи, трейсинг) как фундамент для работы AI-агента. Настраивать умный алертинг, корреляцию и группировку событий
  • разрабатывать и отлаживать tools и playbooks, которыми агент пользуется для диагностики и устранения проблем
  • разбирать инциденты (postmortem) и ошибки агента (ложные срабатывания), на основе анализа повышать точность и полноту автоматического реагирования
  • наполнять и структурировать базу знаний агента (историю инцидентов, документацию), внедрять RAG для улучшения качества автоматических решений
  • работать с инфраструктурным стеком компании: k8s, Istio, Nginx, haproxy, Kafka, Ignite, PostgreSQL, Hashicorp Vault, Nexus, ELK
  • поддерживать и оптимизировать CI/CD-конвейеры нескольких команд
  • работать с R&D задачами различной сложности.

Мы ожидаем, что ты имеешь:

  • высшее образование в сфере IT
  • опыт построения систем мониторинга: логирование (ELK), метрики (Prometheus/Grafana), трейсинг
  • готовность к активной коммуникации с другими командами подразделения
  • опыт работы с Ansible, Istio, Hashicorp Vault
  • опыт построения CI/CD: Jenkins, ArgoCD и т.д.
  • опыт с Git
  • опыт администрирования Linux: Debian/Ubuntu
  • понимание принципов балансировки нагрузки и опыт конфигурации Nginx.

Будет плюсом:

  • опыт настройки, администрирования Apache Ignite и Apache Kafka
  • навыки сборки приложений: Maven, npm
  • опыт работы с PostgreSQL
  • опыт развертывания Kubernetes с нуля, написания Helm-чартов
  • опыт использования AI-агентов для решения инфраструктурных задач и автоматизации.

Работа в Сбере – это:

  • современный офис на Вавилова, 19 с собственным паркингом, столовой, кафетериями, зонами отдыха и спортзалом
  • ежегодный пересмотр зарплаты и годовая премия
  • более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
  • программа адаптации и помощь наставника на старте
  • расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
  • льготная ипотека и кредитование от Сбера
  • бесплатная подписка СберПрайм+, скидки на продукты компаний-партнеров.
Эта вакансия также есть на:hh.ru
Сайты компаний
яндекс

DevOps-инженер в дисковые сервисы Яндекс 360

яндексНа сервисе с: 14.06.26 16:50↑ Вакансия с автоподнятием
Зарплата не указанаНе указана странаЛокация не указана

Яндекс 360 — это Диск, Почта, Документы, Календарь, Телемост, Заметки и другие сервисы с общей многомиллионной аудиторией. Мы делаем продукты для пользователей и для организаций, постоянно повышаем качество и производительность и при этом успеваем экспериментировать с новыми технологиями, чтобы сделать наши приложения ещё более удобными и полезными.

Мы ищем инженера, который поможет нам поддерживать инфраструктуру Яндекс 360 и развивать сервисы. Ждём разработчиков, разбирающихся в администрировании, или администраторов, умеющих программировать. Нам очень важно, чтобы каждый член нашей команды ответственно подходил как к разработке, так и к администрированию.

Проектирование и оптимизация архитектуры

Вы будете выстраивать и оптимизировать архитектуру сервисов, обеспечивая их масштабируемость и отказоустойчивость.

Автоматизация инфраструктуры

В числе ваших задач — автоматизировать развёртывание, конфигурирование и обслуживание инфраструктуры, поддерживать практики IaC с использованием Terraform.

Мониторинг, логирование и реагирование на инциденты

Потребуется настраивать системы мониторинга, чтобы отслеживать ключевые метрики доступности и производительности сервисов. Вы будете оперативно диагностировать и устранять инциденты, минимизируя время простоя сервисов, а также отслеживать показатели SLA/SLI/SLO.

Внедрение и поддержка CI/CD и GitOps

Нужно налаживать и поддерживать процессы CI/CD. Ваша цель — обеспечить воспроизводимость сборок и стабильность процессов развёртывания, а также автоматизировать тестирование и проверку безопасности перед выпуском новых версий.

Работа с инфраструктурой и облачными сервисами

В ваши обязанности входит администрирование баз данных, очередей и другой инфраструктуры. Вы будете управлять облачными ресурсами: создавать виртуальные машины, настраивать сети и балансировщики нагрузки, обеспечивать высокую доступность сервисов. Также вы станете следить за безопасностью инфраструктуры: управлять доступом, настраивать сетевые политики и своевременно обновлять компоненты.

Больше о разработке в Яндексе — в канале Yandex for Developers

* Глубоко знаете Linux, умеете работать в командной строке, знаете Bash
* Работали на практике с контейнеризацией и оркестрацией (Docker, Kubernetes), отлично разбираетесь в них
* Автоматизировали инфраструктуру через IaC, знаете Terraform
* Настраивали и поддерживали системы мониторинга для Kubernetes (например, Prometheus или VictoriaMetrics, Grafana, Alertmanager)
* Умеете организовать сбор и анализ логов (Vector, Fluent Bit, Loki, стек ELK)
* Работали с CI/CD-платформами (например, GitLab CI, GitHub Actions, Azure DevOps и т. п.)
* Администрировали PostgreSQL
* Умеете разрабатывать инструменты автоматизации на Python
* Работали хотя бы с одним крупным облачным провайдером (Yandex Cloud, AWS, Azure, Google)

* Работали с GitOps-инструментами (ArgoCD, Flux CD)
* Знакомы с Kafka
* Имели дело с ClickHouse

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.