С

SRE-инженер (Python)

Сбер2В — система бизнес-сервисов под единым управлением. Вместе мы решаем комплексные задачи государства, бизнеса и регионов с помощью аналитики больших данных, искусственного интеллекта, автоматизации и ЭДО.

сбер2в · На сервисе с: 08.09.26 20:28

Зарплата не указанаРоссияМоскваОфис

Сбер2В — система бизнес-сервисов под единым управлением. Вместе мы решаем комплексные задачи государства, бизнеса и регионов с помощью аналитики больших данных, искусственного интеллекта, автоматизации и ЭДО.

Мы в цифрах:
• 50+ собственных решений
• 1,2 млн клиентов малого бизнеса
• 40+ отраслей используют наши продукты
• 2,5 тыс. клиентов крупного бизнеса и госсектора

Наши технологии (аналитика больших данных, машинное обучения, визуализация) помогают бизнесу расти, а регионам — развиваться.

Сейчас мы находимся в поисках Ведущего инженера SRE в наше Управление продуктовой стабильности и релизов. Команда обеспечивает сквозные процессы поддержки продуктов холдинга из 8 дочерне зависимых обществ:

- Инцидент-менеджмент — управление инцидентами, координация реагирования, восстановление стабильности продуктов

- Управление надёжностью продуктов — обеспечение и повышение надёжности (SLO/SLI, бюджеты ошибок, мониторинг)

- Поставка ценности на стенды — обеспечение процессов CI/CD, развёртывание релизов

- Управление изменениями — контроль и сопровождение изменений в промышленной среде

Новому участнику нашей ИТ-команды предстоит плечом к плечу работать с командами продуктов Сбер2В, обеспечивая эксплуатационную готовность и стабильность сервисов.

Чем предстоит заниматься:

  • Координировать инциденты P0/P1, включая формирование рабочей группы при их возникновении, распределение задач, диагностику, принятие решений об откате и деградации, разбор без поиска виновных
  • Управлять проблемами: проводить анализ первопричин, формировать программы мероприятий и осуществлять контроль их исполнения
  • Управлять изменениями: проводить оценку рисков, авторизацию изменений в промышленную среду, участвовать в CAB
  • Проектировать мониторинг и наблюдаемость: метрики, логи, трейсы, многоуровневые SLO/SLI, аудит качества
  • Проектировать архитектуры надёжности: отказоустойчивость, multi-AZ, деградация, ограничители нагрузки
  • Сопровождать релизы и приёмку сервисов в эксплуатацию (ПСИ)
  • Планировать ёмкость, проводить хаос-эксперименты и тестирование аварийного восстановления (DRT)
  • Формировать стандарты SRE для направления, заниматься наставничеством младших инженеров

Мы будем рады познакомиться, если у тебя есть:

  • Опыт работы в ИТ от 5ти лет, в эксплуатации или SRE от 3х лет
  • Опыт ведения инцидентов P2/P1 и проектирования мониторинга, SLO, инструкций реагирования
  • Технические знания и опыт работы с: Linux, Kubernetes / OpenShift, Prometheus, Grafana, ELK, Loki (и аналоги)
  • Знания и опыт работы с сетями: TCP/IP, DNS, HTTP/HTTPS, балансировка, ingress-контроллеры, сервис-меш
  • Стремление автоматизировать свою работу: уверенно писать скрипты на Bash, применять Python на уровне инженерных автоматизаций
  • Понимание архитектуры надёжности: отказоустойчивость, multi-AZ, деградация, ограничители нагрузки, идемпотентность
  • Опыт ведения инцидентного процесса P0/P1 в роли координатора, с управлением боевыми комнатами, разбором и эскалациями
  • Опыт работы с базами данных, включая репликацию, шардирование, резервное копирование и диагностику производительности
  • Умение выстраивать конструктивную коммуникацию с разработкой, DevOps и инфраструктурой

Будет преимуществом/плюсом:

  • Опыт работы в холдинговой структуре с несколькими компаниями
  • Опыт миграций между ЦОД, облачными провайдерами, кластерами
  • Опыт внедрения SLO/бюджета ошибок в продуктах
  • Опыт участия в CAB
  • Опыт работы с ITSM-системами класса Naumen, Jira ServiceDesk

Что мы предлагаем:

  • Работу в аккредитованной IT-компании
  • Удобный офис (м. Калужская, ул. Обручева 30/1 с.2)
  • Ежегодный бонус по итогам работы
  • Подключение к ДМС, телемедицина, чек-ап – после прохождения испытательного срока
  • Ведение беременности и родов, лазерная коррекция зрения и стоматология после 2х лет непрерывного стажа в группе Сбер
  • Специальные условия для страхования семьи
  • Возможность участия в корпоративной пенсионной программе
  • Корпоративное обучение
  • Бесплатную подписку на СберПрайм и скидки у партнёров
  • Новогодние подарки для детей, корпоративные мероприятия и поддержку в особых жизненных ситуациях
  • Скидки в спортклубы X-Fit, WorldClass

Почему у нас классно работать:

  • Видимый результат: твой вклад напрямую влияет на продукт и развитие компании
  • Минимизируем бюрократию, даем возможность проявлять инициативу
  • Есть возможность карьерного роста внутри команды или других подразделений
  • Вклад в развитие общества: наши исследования способствуют улучшению экономики регионов и качества жизни людей

Мы верим в силу данных как инструмента позитивных изменений.

Похожие вакансии DevOps

hh.ru
нпп баум

SRE-инженер

нпп баумНа сервисе с: 25.08.26 18:32↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМоскваГибрид

Мы — группа компаний, успешно объединяющая экспертизу в IT, проектировании и строительстве. Одно из наших ключевых направлений — сопровождение и развитие корпоративной IT-инфраструктуры и информационной безопасности внешних заказчиков.

Сейчас мы развиваем SRE направление, поэтому ищем опытного инженера, который будет проектировать отказоустойчивую архитектуру и выстраивать процессы.

Чем предстоит заниматься:

  • Проектировать и развивать observability: метрики, логи, трейсинг
  • Настраивать осмысленный алертинг — без шума, с приоритизацией по реальному влиянию на сервис
  • Участвовать в расследовании инцидентов, искать фундаментальную причину проблемы, а не только устранять симптом
  • Готовить структурированные разборы инцидентов и предлагать системные меры для предотвращения повторений
  • Взаимодействовать с инженерами и командами проектов, помогая выстраивать единый подход к мониторингу и надёжности

Что для нас важно:

  • Опыт в роли SRE от ~3 лет с опытом именно построения observability, а не только его поддержки
  • Уверенный опыт с Prometheus/Grafana, опыт работы с логированием и трейсингом (Loki и Tempo)
  • Опыт работы с docker, kubernetes
  • Опыт самостоятельного расследования инцидентов и написания post-mortem с фокусом на корневые причины
  • Готовность выстраивать процессы там, где их пока нет, без готовых шаблонов
  • Уверенный опыт с Linux системами, понимание принципов отказоустойчивости (репликация, кластеризация, балансировка, failover)

Будет плюсом:

  • Опыт внедрения SLI/SLO и работы с error budget на практике
  • Навыки автоматизации (Ansible, Python/Bash)

Мы предлагаем:

  • Надёжность: официальное оформление в штат по ТК РФ, ИТ-аккредитация, достойный прозрачный доход и премии по итогам работы

  • Гибридный формат: возможность совмещать работу из дома и офиса

  • Комфорт: современный офис рядом с м. Волгоградский проспект/Пролетарская

  • Оснащение: вся необходимая современная техника и компенсация корпоративной мобильной связи

  • Забота о здоровье: ДМС со стоматологией после испытательного срока

  • Корпоративные скидки: подключение к программе Best Benefits со скидками от партнеров с первого рабочего дня

  • Развитие: возможности для профессионального роста, открытая коммуникация и сильная команда экспертов

hh.ru
skillstaff

DevOps-инженер (Senior)

skillstaffНа сервисе с: 24.09.26 20:25
Зарплата не указанаРоссияМоскваУдалёнка
Мы ищем опытного DevOps-инженера
Ключевая задача - построить инфраструктуру с нуля. Продукт переезжает в контур и нужен человек, который спроектирует всё правильно с самого начала, настроит CI/CD, поднимет кластер и сделает так, чтобы команды разработки могли работать без "боли". Сейчас оркестрация на Docker Swarm и на время переезда планируется оставить на нём, а после завершения рассматривается переход на Kubernetes.

Стек: Docker, Docker Swarm, GitLab CI/CD, Nginx, PostgreSQL, Percona XtraDB Cluster (MySQL 8.0, Galera), Redis, S3-совместимое хранилище, в перспективе Kubernetes. Мониторинг: Prometheus, Grafana, Loki, Zabbix.
Облако на базе отечественных провайдеров.

Чем предстоит заниматься:

  • Проектировать и разворачивать инфраструктуру с нуля.
  • Настраивать CI/CD пайплайны для фронта и бэка, поднимать и сопровождать кластер Docker Swarm и выстраивать процессы деплоя, а после переезда спроектировать и провести миграцию на Kubernetes.
  • Администрировать кластер Percona XtraDB Cluster (отказоустойчивость, бэкапы, восстановление).
  • Настраивать мониторинг, алертинг и логирование, работать в связке с командами разработки, участвовать в технических переговорах с подрядчиками.

Для нас важно:

  • Опыт коммерческой работы в DevOps или SRE от 5-ти лет.
  • Реальный опыт проектирования инфраструктуры с нуля, а не только поддержка существующей.
  • Опыт работы с Docker Swarm в продакшне, уверенное знание Kubernetes в продакшне.
  • Опыт настройки GitLab CI/CD с раннерами и пайплайнами.
  • Понимание сетевой модели и проксирования через Nginx.
  • Опыт эксплуатации Percona XtraDB Cluster/Galera в продакшне (кворум и split-brain, SST/IST, bootstrap кластера после падения, бэкапы через Percona XtraBackup).
  • Опыт работы с Zabbix.
  • Опыт с отечественными облачными провайдерами (Yandex Cloud) и знание IaC-инструментов (Terraform, Ansible).

Главный принцип SkillStaff - Выбирай!

  • РАЗНООБРАЗИЕ ПРОЕКТОВ. Выбирай из сотен компаний и проектов то, что интересно и полезно для твоего роста. SkillStaff помогает реализовывать ежегодно порядка 500 различных ИТ-проектов для крупного бизнеса.
  • КОМФОРТ. SkillStaff — аккредитованная IT-компания, белая зарплата и удобный график работы. Создавай идеальные условия для своей работы: удаленная работа или возможность работать как в офисе клиента, так и в комфортном офисе SkillStaff в центре Москвы на Воздвиженке.
  • РАЗВИТИЕ. Выбирай сам путь, по которому ты хочешь развиваться. Используй возможность обмена опытом и получение знаний через участие в разных проектах, совместную работу с высококвалифицированными коллегами.
  • КУЛЬТУРА. Нашу культуру создают сами сотрудники – мы их слышим и помогаем развиваться, чтобы #вместе переходить на новый уровень!
hh.ru
bi.zone направление разработка

Инженер систем мониторинга

bi.zone направление разработкаНа сервисе с: 24.09.26 19:18
Зарплата не указанаРоссияМоскваУдалёнка

BI.ZONE создает IT-продукты для обеспечения кибербезопасности: от мобильных приложений до сложных платформ, в основе которых лежат методы машинного обучения. Благодаря нашим решениям жизнь десятков миллионов людей становится лучше и безопаснее.

Сейчас в команду мы ищем инженера аналитика систем мониторинга, который будет развивать системы логирования и мониторинга, администрировать Linux и PostgreSQL, автоматизировать инфраструктуру и выстраивать отказоустойчивые масштабируемые решения.

Чем предстоит заниматься:

  • Развитие систем мониторинга и логирования;
  • Внесение изменений и корректировок в системы мониторинга команды, участие в постановке новых сервисов на мониторинг;
  • Участие в поддержке, оптимизации и развитии инфраструктуры компании;
  • Внедрение и настройка стека технологий мониторинга (Prometheus, Zabbix, Grafana) с учётом требований отказоустойчивости и масштабируемости.
  • Внедрение и настройка стека технологий логирования (VictoriaMetrics, ELK/GrayLog, Syslog) с учётом требований отказоустойчивости и масштабируемости.

Что для нас важно:

  • Глубокие знания, опыт эксплуатации и сопровождения операционных систем семейства Linux (Oracle Linux 8, Debian, Ubuntu);
  • Опыт внедрения и сопровождения IT систем;
  • Опыт развертывания, настройки и администрирования инфраструктурных сервисов (Zabbix, Grafana, Prometheus, ELK, VictoriaMetrics);
  • Знание, опыт работы с PostgreSQL;
  • Опыт работы с платформой виртуализации VMware vSphere(ESXi, vCenter Server)
  • Опыт работы с системами автоматизации инфраструктуры и контроля версий(GitLab, Ansible, Docker, Terraform);
  • Soft-skills: коммуникативность, развитый time-management, инициативность, адаптируемость, а также желание профессионально и карьерно развиваться

Что нам также важно, но можем рассмотреть кандидатов и без этого:

  • Опыт настройки CI/CD систем (GitLab CI/CD);
  • Опыт работы с платформой виртуализации VMware vSphere(ESXi, vCenter Server);
  • Опыт работы с системами автоматизации инфраструктуры и контроля версий(GitLab, Ansible, Docker, Terraform).

Мы предлагаем:

Защищенность Все гарантии официального оформления по ТК РФ и преимущества аккредитованной IT-компании


Сообщества Регулярные профессиональные митапы и встречи для обмена опытом. А также сообщества по интересам: спорт, игры, книги, аниме

Гибкий график
Никто не следит, когда сотрудник садится за компьютер, сколько часов проводит в офисе, как часто работает удаленно

Забота о здоровье ДМС со стоматологией c первого месяца работы в компании

Обучение Сертификация, профильные курсы, конференции, митапы, хакатоны, CTF-ы

Свободная атмосфера У нас на «ты», никакого дресс-кода и лишней бюрократии

Самореализация Поддержка креатива и воплощение идей. Можно профессионально расти и развивать личный бренд

Скидки на фитнес, покупки и многое другое

Скидки от BestBenefits, «Фитмост», «СберПрайм+»и других компаний-партнеров для всех сотрудников

Корпоративная жизнь Крутые внутренние мероприятия и участие в спортивных стартах, а еще мерч и подарки

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.