мтс, работа в it

Ведущий SRE-инженер [Скоринг, МТС Веб Сервисы]

BIG DATA МТС – место, где телеком данные превращаются в реально работающие IT-продукты. Мы создали и протестировали несколько десятков сервисов. Самые успешные из них уже стали частью экосистемы МТС. Например, МТС Маркетолог, рекомендации…

мтс, работа в it · На сервисе с: 01.10.26 15:18

Зарплата не указанаРоссияМоскваГибрид

BIG DATA МТС – место, где телеком данные превращаются в реально работающие IT-продукты. Мы создали и протестировали несколько десятков сервисов. Самые успешные из них уже стали частью экосистемы МТС. Например, МТС Маркетолог, рекомендации в KION (МТС ТВ), услуга “Кто звонит?” или Спам blacklist.

КОГО МЫ ИЩЕМ?

SENIOR PRODUCT SRE В ПРОДУКТ СКОРИНГ

ОПИСАНИЕ ПРОДУКТА:
Скоринг - это коммерческий B2B продукт для уменьшения рисков и затрат B2B-клиентов. Скоринг состоит из 2-х направлений: рисковый и антифрод.

ЧЕМ ПРЕДСТОИТ ЗАНИМАТЬСЯ

  • Обеспечивать и развивать надежность ИТ-продукта: формировать технический бэклог по SRE-направлению, приоритизировать задачи по устранению технического долга внутри продукта.
  • Внедрять методологию управления надежностью (SLA/SLO/SLI) для сервисов продукта, проектировать сквозные метрики стабильности инфраструктуры и приложений.
  • Разрабатывать и внедрять архитектурные стандарты отказоустойчивости распределенных компонентов внутри продукта (highload-сервисы, очереди, аналитические БД).
  • Построить и развивать систему сквозной наблюдаемости (Observability): проектировать и внедрять кастомные метрики, дашборды, логирование и распределенную трассировку для всей инфраструктуры продукта.
  • Локализовать и устранять инциденты: участвовать в дежурствах (on-call), организовывать разбор аварий (Post-mortem), находить корневые причины сбоев (Root Cause) и автоматизировать их предотвращение.
  • Плотно взаимодействовать с командой разработки: помогать разработчикам и аналитикам проектировать архитектуру приложения с учетом нефункциональных требований и бюджетов ошибок (Error Budgets).

ЧТО НУЖНО ДЛЯ ЭТОЙ РАБОТЫ

  • Опыт работы в роли SRE / Infrastructure / DevOps / Platform Engineer от 3–5 лет в крупных высоконагруженных или Big Data проектах.

  • Отличное понимание Highload-архитектуры и специфики Big Data решений: практический опыт работы с распределенными брокерами (Apache Kafka), аналитическими БД (Hadoop, ClickHouse) и микросервисами.

  • Глубокие знания в области построения систем Observability: экспертное владение стеком Prometheus, VictoriaMetrics, OpenTelemetry, Grafana; умение настраивать сквозной мониторинг от системных до бизнес-метрик.

  • Понимание архитектурных паттернов отказоустойчивости распределенных систем (Circuit Breaker, Rate Limiting, Graceful Shutdown, механизмы репликации и кэширования).

  • Инженерный подход к разбору инцидентов: опыт внедрения культуры Post-mortem, умение декомпозировать сложные системные аварии на понятные технические задачи.

  • Развитые коммуникативные навыки: умение аргументированно защищать требования к надежности перед командой разработки и совместно находить баланс между скоростью доставки фич и стабильностью системы.

ЧТО ПРЕДЛАГАЕМ

  • собственную платформу MTS Ocean для получения ИТ-ресурсов, а это значит, что деплой, мониторинг, observability — не будут для тебя проблемой, ты сможешь сосредоточиться на фичах;

  • профессиональные гильдии инженеров, где мы поддерживаем друг друга и помогаем стать лучше;

  • внутреннюю площадку TechTalks для обмена опытом, дискуссий, развития навыков самопрезентации;

  • участие во внешних IT конференциях. Мы выступаем на HighLoad++, DataFest, Mobius, Test Driven Conf, Joker, DevOps, Матемаркетинг и даже проводим собственную конференцию по архитектуре True Tech Arch;

  • полезные курсы и вебинары в корпоративном университете и электронную библиотеку.

А еще:

  • ДМС с первого месяца работы, включая стоматологию;

  • страхование от несчастных случаев с 1 месяца работы. Материальную помощь в сложных жизненных ситуациях;

  • отпуск 28 календарных дней;

  • прием врачей общей практики и массаж в офисе;

  • мобильная связь за счет компании и льготные тарифы для близких;

  • подписка на онлайн-кинотеатр KION, сервис МТС Музыка, книжный сервис Строки от МТС, безлимитные мессенджеры и соцсети.

Похожие вакансии DevOps

Соц.сети
Н

System engineer

Неизвестный работодательНа сервисе с: 01.10.26 16:08
Зарплата не указанаАзербайджанГибрид

System engineer | ID: 2271

Company: NDA
Industry: iGaming
Work mode: Hybrid / On-site / Remote

Description:
Ищем Systems Engineer / SRE в инфраструктурную команду iGaming-проекта (Азербайджан).

Задачи:
— Автоматизация инфраструктуры, CI-пайплайны;
— Миграция между ДЦ, запуск новых проектов;
— Решение инцидентов (тикеты, мониторинг).

Требования:
— Опыт от 5 лет, высшее тех. образование;
— Отличное знание Linux/Unix;
— Ansible/Puppet, контейнеризация, SQL/NoSQL;
— Написание скриптов (Shell + 1 язык).

Стек:
Kubernetes, Terraform, Helm, ClickHouse, ELK, PostgreSQL, Kafka, MongoDB, Vault.

hh.ru
сбер2b

DevOps-инженер (Навигатор BI)

сбер2bНа сервисе с: 07.08.26 16:01↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМоскваГибрид

Сбер2В — система бизнес-сервисов под единым управлением. Вместе мы решаем комплексные задачи государства, бизнеса и регионов с помощью аналитики больших данных, искусственного интеллекта, автоматизации и ЭДО.

Мы в цифрах:
• 50+ собственных решений
• 1,2 млн клиентов малого бизнеса
• 40+ отраслей используют наши продукты
• 2,5 тыс. клиентов крупного бизнеса и госсектора

Наши технологии (аналитика больших данных, машинное обучения, визуализация) помогают бизнесу расти, а регионам — развиваться.

Российская платформа Навигатор BI — это комплекс инструментов для обработки и анализа информации, представляющий её в виде дэшбордов и интерактивных форматов визуализации.
Платформа помогает выявлять взаимосвязи в данных, строить управление на основе отклонений и отслеживать тренды, что позволяет принимать обоснованные решения и эффективно управлять бизнесом, в том числе с применением технологий искусственного интеллекта (ИИ).

Благодаря активному развитию продукта команда Навигатор находится в поисках DevOps-инженера на задачи по внедрению модуля AI нашим заказчикам. Для этой цели нам нужен опытный эксперт с релевантным коммерческим опытом, знакомый со спецификой AI-продуктов и открытый к коммуникациям с клиентами (обучение, FAQ).

Чем предстоит заниматься:

  • Разворачивать и сопровождать AI-сервис и агентную платформу в различных окружениях: от локальных стендов разработчика до тестовых и продуктивных сред
  • Готовить и проверять сценарии установки всех компонентов (Python-окружение, OpenSearch, PostgreSQL, микросервисы) на разных операционных системах
  • Заниматься контейнеризацией компонентов системы: оптимизировать Docker-файлы, настраивать Docker Compose-стенды для быстрого развёртывания
  • Тестировать совместимость агентной логики с различными платформами, выявлять и устранять проблемы, связанные с различиями ОС, файловых систем и сетевых окружений
  • Автоматизировать процессы сборки, тестирования и доставки (CI/CD-пайплайны), внедрять практики воспроизводимых развёртываний
  • Документировать процедуры установки и настройки для внешних клиентов (в малых объемах - точечные истории, инструкции, FAQ)
  • Взаимодействовать с разработчиками для оптимизации процесса

Мы будем рады познакомиться, если у тебя есть:

  • Опыт уверенного администрирования Linux (понимание процессов, пакетных менеджеров, сетей)
  • Знание Docker/Docker Compose: написание образов, управление сетями и томами, оптимизация размера и безопасности
  • Понимание того, как установить и настроить Python-проекты, OpenSearch и PostgreSQL в разных ОС (включая особенности путей, переменных окружения, прав доступа)
  • Опыт написания скриптов автоматизации на Bash и/или Python
  • Практический опыт построения CI/CD-пайплайнов (сборка, тестирование, деплой)
  • Понимание принципов микросервисной архитектуры

Будет преимуществом/плюсом:

  • Опыт развёртывания AI/LLM-приложений или агентных систем (LangChain, LangGraph и т.п.)
  • Знание MLOps-практик: мониторинг моделей, управление экспериментальными окружениями
  • Работа с поисковыми и векторными движками на уровне конфигурации (OpenSearch/Elasticsearch)
  • Опыт оркестрации контейнеров (Kubernetes)

Что мы предлагаем:

  • Работу в аккредитованной IT-компании
  • Удобный офис (м.Кутузовская)
  • Ежегодный бонус по итогам работы
  • Подключение к ДМС, телемедицина, чек-ап – после прохождения испытательного срока
  • Ведение беременности и родов, лазерная коррекция зрения и стоматология после 2х лет непрерывного стажа в группе Сбер
  • Специальные условия для страхования семьи
  • Возможность участия в корпоративной пенсионной программе
  • Корпоративное обучение
  • Бесплатную подписку на СберПрайм и скидки у партнёров
  • Новогодние подарки для детей, корпоративные мероприятия и поддержку в особых жизненных ситуациях
  • Скидки в спортклубы X-Fit, WorldClass

Почему у нас классно работать:

  • Видимый результат: твой вклад напрямую влияет на продукт и развитие компании
  • Минимизируем бюрократию, даем возможность проявлять инициативу
  • Есть возможность карьерного роста внутри команды или других подразделений
  • Вклад в развитие общества: наши исследования способствуют улучшению экономики регионов и качества жизни людей

Мы верим в силу данных как инструмента позитивных изменений.

hh.ru
Зарплата не указанаРоссияМоскваУдалёнка

Мы ищем специалиста, который обеспечит стабильную и предсказуемую работу наших информационных систем на базе 1С и MS SQL. Ваша главная цель — не просто «чинить», а системно повышать надёжность: внедрять метрики, автоматизировать обнаружение проблем, проектировать отказоустойчивость и устранять первопричины сбоев. Роль предполагает выделение до 10 % времени команд на задачи по надёжности и улучшению процессов.

Тебе предстоит:

Управление инцидентами и постмортемы

  • Координировать участников «пожарной команды» для оперативного решения критических инцидентов.
  • Собирать информацию о проблеме, контролировать заведение аварии, фиксировать хронометраж и ключевые действия.
  • Писать постмортем‑отчёты (blameless postmortem): фиксировать, что произошло, как реагировали, какие уроки извлечены.
  • Контролировать и ставить задачи по недопущению повторения причин инцидентов (RCA, action items).

​​​​​​​Производительность и доступность

  • Определять и поддерживать SLI/SLO для ключевых сервисов, вести учёт error budget.
  • Настраивать и анализировать ключевые показатели ИС: создавать дашборды, алерты, описывать реакцию на отклонения.
  • Писать инструкции (runbooks) по реакции на отклонения показателей работы от нормы.
  • Анализировать аномалии: рост нагрузки, рост данных, нехарактерные паттерны поведения системы.

Анализ логов и диагностика

  • Анализировать Журнал регистрации (ЖР) и Технологический журнал (ТЖ) на наличие ошибок и узких мест.
  • Сопоставлять данные из разных источников (логи, метрики, трейсы) для точной локализации проблемы.

Масштабирование и отказоустойчивость

  • Участвовать в проектировании и реализации отказоустойчивой архитектуры (кластеризация 1С, Always On для MS SQL, балансировка нагрузки и т. д.).
  • Готовить систему к пиковым нагрузкам: нагрузочное тестирование, планирование ёмкости, проработка сценариев деградации.

Регулярное обслуживание и гигиена данных

  • Выполнять и автоматизировать типовые операции обслуживания: пересчёт итогов, очистка регистров, удаление нулевых записей.
  • Ставить задачи и предлагать решения, чтобы такие операции требовались реже или выполнялись автоматически.

Пожелания по опыту:

  • Опыт разработки на платформе 1С: понимание архитектуры регистров, сеансов, блокировок, умение читать ЖР и ТЖ.
  • Уверенная работа с MS SQL: планы запросов, блокировки, DMV, Extended Events, тюнинг производительности.
  • Практический опыт работы с инструментами мониторинга и наблюдаемости: Zabbix, Prometheus, Grafana, ELK.
  • Понимание SRE‑практик: SLI/SLO, error budget, incident management, blameless postmortem, runbooks.
  • Умение проектировать отказоустойчивые и масштабируемые решения, опыт подготовки к пиковым нагрузкам.
  • Способность формализовать процессы, писать понятные инструкции и ставить задачи смежным командам.

Будет плюсом

  • Опыт внедрения автоматизации для типовых операций обслуживания.
  • Знание практик Capacity Planning и Chaos Engineering на базовом уровне.
  • Опыт работы в кросс‑функциональных командах и проведения ретроспектив по инцидентам.

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.