yandex cloud

SRE (Managed Kubernetes)

Yandex Cloud — технологическая платформа для создания и развития ИТ-продуктов, а наш сервис Managed Kubernetes — её ключевая часть, которая служит фундаментом для тысяч кластеров наших клиентов и критически важных внутренних сервисов Яндек…

yandex cloud · На сервисе с: 04.08.26 16:26

400k–600k ₽РоссияСербияМоскваГибрид

Yandex Cloud — технологическая платформа для создания и развития ИТ-продуктов, а наш сервис Managed Kubernetes — её ключевая часть, которая служит фундаментом для тысяч кластеров наших клиентов и критически важных внутренних сервисов Яндекса.

Наша команда отвечает за бесперебойную работу Managed Kubernetes и развитие в условиях постоянного роста. Мы проектируем, масштабируем и автоматизируем инфраструктуру, которая включает тысячи серверов и Kubernetes-кластеров в нескольких дата-центрах. Этот масштаб создаёт уникальные инженерные задачи в области надёжности, автоматизации и предсказуемого масштабирования, которые нам предстоит решать.

В качестве SRE вы будете отвечать за развёртывание управляющих компонентов и необходимой для них инфраструктуры, поддержание надёжности и производительности как внутренних сервисов, так и кластеров внешних клиентов и адаптацию новых облачных технологий к процессам разработки.

Мы — коллектив инженеров, которые ценят глубину экспертности, открытость и взаимопомощь. У нас нет культуры «героя-одиночки»: сложные инциденты мы решаем вместе, а идеи по улучшению архитектуры всегда находят поддержку. Мы работаем в тесном контакте с разработчиками платформы, что позволяет влиять на продукт на всех этапах.

В работе мы используем

  • Golang — для разработки сервисов и автоматики.
  • Terraform — для описания инфраструктуры.
  • TeamCity и Spinnaker — для процессов CI/CD.

Какие задачи вас ждут

Infrastructure as Code

Вам предстоит создавать и внедрять единый стандарт IaC для сложной, географически распределённой инфраструктуры, влиять на стабильность и скорость развёртывания всего сервиса, создавать единый, понятный, удобный, гибкий способ доставлять изменения в облачные ресурсы и приложения.

SDLC

Вы будете строить и автоматизировать SDLC через CI/CD-пайплайны (TeamCity, Spinnaker) для безопасного и удобного применения изменений конфигураций десятков приложений, сотен облачных ресурсов и большого количества кластеров со всем разнообразием их компонентов. Будете напрямую влиять на скорость и безопасность доставки фич пользователям, улучшение Developer Experience для всей команды разработки, создание инструментов, которыми будут пользоваться каждый день.

On-call-дежурства и SRE-мониторинг

Вам нужно будет расследовать и устранять уникальные и сложные инциденты, требующие глубокой экспертности на уровне ОС, K8s, сети и облачных сервисов, что позволяет постоянно расширять технический кругозор и навыки. Вы будете работать в рамках отлаженных и зрелых on-call-процессов, включающих blameless post-mortems, сбалансированную ротацию и систему взаимной поддержки. Кроме того, вам предстоит строить современную observability-платформу на базе облачных сервисов для инфраструктуры большого масштаба: не просто настраивать алерты, а создавать систему, способную отслеживать аномалии в тысячах объектов и десятках паттернов их использования и реагировать на них.

Безопасность

Вы будете развивать решения, соответствующие стандартам безопасности (PCI DSS, ГОСТ Р 57580, ISO 27001), и решения, позволяющие обновить десяток сервисных компонентов разных версий на тысячи нод без деградации текущей функциональности.

Облачные технологии

Вам предстоит адаптировать опенсорсные и проприетарные инструменты и технологии как для внутреннего потребления, так и для внешних клиентов. Вы сможете быть на острие технологий: пробовать не только опенсорс-инструменты, но и их аналоги, построенные на основе больших систем Яндекса и с учётом его многолетнего опыта, проводить их глубокий анализ, сравнивать с аналогами и внедрять лучшие из них на основе продакшн-опыта Яндекса.

Мы ждём, что вы

  • Способны взять на себя ответственность в одном или нескольких ключевых описанных направлениях.
  • Обладаете экспертностью, которая позволит вам определять подход, влиять на архитектуру и напрямую улучшать продукт.

Бенефиты работы в Яндексе

Здоровье

Расширенная медицинская страховка начинает работать с первого месяца в Яндексе. В неё входят:

  • Базовые услуги

Плановая помощь и неотложная за рубежом, страхование от несчастных случаев для любителей активного отдыха и лечение критических заболеваний.

  • Ментальное здоровье

Врачи в клиниках по ДМС, онлайн-консультации с психологами. А также психотерапия в офисах, где есть кабинет психотерапевта.

  • Ежегодные чекапы

Мы за превентивную заботу о здоровье, поэтому по ДМС можно проходить чекапы и регулярно вакцинироваться.

  • Больничный

30 дней в году оплачиваются — вы получите полную зарплату, как будто не болели.

  • Стоматология

Плановые процедуры, профессиональная чистка и экстренная помощь за рубежом.

  • Коррекция зрения

После года работы ДМС покрывает коррекцию зрения и хирургическое лечение косоглазия.

  • Терапевты в офисах

Если почувствовали себя неважно, можно обратиться в кабинет врача-терапевта, такие есть во всех крупных офисах Яндекса.

  • Ведение беременности и роды

Оплачиваем ведение беременности и роды для сотрудниц и жён сотрудников, которые с нами более двух лет.

Страховка для родственников по системе 80/20: мы оплачиваем 80% стоимости ДМС для детей и супругов, вы — остальные 20%. В страховку входит всё то же самое, что и у вас.

Рост и развитие

В Яндексе есть всё, чтобы постоянно развиваться и учиться новому:

  • Обучение

В Яндексе есть собственная образовательная платформа с более чем 700 курсами и специальные программы для начинающих и опытных руководителей.

  • Профессиональные сообщества

Для проджектов и продактов, аналитиков, дизайнеров, рекрутеров и других специалистов.

  • Профильные конференции

Также мы оплачиваем участие в профильных конференциях — как в качестве спикера, так и в качестве участника.

Спорт

Мы любим спорт и считаем его важной частью хорошего самочувствия каждого яндексоида. Поэтому у нас есть:

  • Спортзалы в офисе

Во всех крупных офисах Яндекса есть спортзалы со всем необходимым. Можно заниматься самостоятельно или позвать своего тренера.

  • Спортивные клубы

В Яндексе есть спортивный клуб и много спортивных команд. У них есть свои лидеры, чаты, программы тренировок. А ещё они регулярно участвуют в соревнованиях.

  • Специальные события

Фестивали спорта и здорового образа жизни, уникальные спортивные проекты во дворах офисов.

  • Спорт вне офиса

У нас есть скидки в фитнес-клубах, бассейнах, студиях йоги, на скалодромах и в других местах.

И ещё

  • Жилищные займы

Льготная ставка на покупку жилья и улучшение жилищных условий — в зависимости от стажа, позиции и результатов ревью. Действует для сотрудников, работающих в российских офисах Яндекса.

  • Скидки на услуги и сервисы

На внутреннем портале можно найти сотни услуг и сервисов. Также при оплате зарплатной картой можно получать повышенный кешбэк и дополнительные скидки.

  • Детские образовательные проекты

Специальные образовательные проекты от наших сервисов для мини-яндексоидов разных возрастов — офлайн и онлайн.

  • Подписка Плюса

Для всех яндексоидов.

Похожие вакансии DevOps

hh.ru
тантк им.г.м. бериева

Devops инженер

тантк им.г.м. бериеваНа сервисе с: 24.09.26 19:09
55k–70k ₽РоссияТаганрогОфис
Погрузитесь в мир современных технологий и станьте ключевым звеном в организации web серверной архитектуры!

Обязанности
  • Проектирование, развертывание и поддержка серверной инфраструктуры
  • Автоматизация процессов развертывания и мониторинга
  • Обеспечение безопасности и отказоустойчивости систем
  • Оптимизация производительности серверов и приложений
  • Взаимодействие с командами разработки и эксплуатации
Требования
  • Знание Windows/Linux-систем и сетевых технологий
  • Опыт работы с системами автоматизации (Ansible, Terraform и др.)
  • Понимание принципов CI/CD
  • Навыки работы с контейнерами и оркестраторами (Docker, Kubernetes)
  • Умение работать в команде и решать нестандартные задачи
hh.ru
защитаинфотранс, фгуп

Системный администратор инфраструктуры и баз данных ГИС

защитаинфотранс, фгупНа сервисе с: 24.09.26 18:40
Зарплата не указанаРоссияМоскваВладивостокУдалёнка
Локации (удалёнка):МоскваВладивосток

Удалённая работа — географически не привязана. Щёлкни по любой из локаций, чтобы открыть оригинальную карточку.

ФГУП "ЗащитаИнфоТранс" - аккредитованная государственная IT-компания, специализирующаяся на цифровизации и внедрении инноваций в транспортной отрасли, эксперт в области защиты информации и обеспечения транспортной безопасности.

С 1996 года успешно реализовано более 180 масштабных проектов по разработке информационных систем для всей транспортной отрасли.

Приглашаем в команду Ведущего инженера в Отдел эксплуатации инфраструктуры и баз данных Департамента эксплуатации информационных систем.
Работа с государственной информационной системой Электронные перевозочные документы.

Чем предстоит заниматься?

Вы будете центральным звеном технической поддержки системы. Ежедневно вы будете диагностировать и устранять сложные технические проблемы, анализировать метрики и логи, координировать работу с разработчиками и специалистами по информационной безопасности. Вы обеспечите работоспособность контейнеризированных приложений, поддержите интеграции с внешними системами и постоянно актуализируете базу знаний для повышения эффективности команды.

Эта позиция подойдет опытному техническому специалисту, который готов работать с критической государственной инфраструктурой, принимать самостоятельные решения в условиях ограниченного времени и обеспечивать высокий уровень доступности сервисов.

ЗАДАЧИ и ФУНКЦИОНАЛ:

1. Поддержка инцидентов:

  • Прием эскалированных обращений от первой линии поддержки и самостоятельная диагностика сложных технических проблем;
  • Анализ логов и метрик для выявления причин сбоев, применение решений для восстановления работоспособности в рамках SLA;
  • Подготовка полной диагностической информации для передачи на третью линию или производителям при необходимости.

2. Администрирование инфраструктуры и платформ:

  • Управление виртуальной инфраструктурой на облачной платформе ГЕОП (или аналог): жизненный цикл ВМ, базовые сетевые настройки, шаблоны/копии;
  • Администрирование серверов под управлением Linux, администрирование, сервисы ОС, анализ системных журналов;
  • Эксплуатация платформы контейнеризации Kubernetes: управление кластерами, диагностика проблем с приложениями и сервисами;
  • Работа с контейнерами Docker, администрирование веб-серверов Nginx и Apache;

3. Управление базами данных и интеграциями:

  • Администрирование СУБД PostgreSQL: резервное копирование, восстановление, мониторинг производительности и репликации;
  • Поддержка высокодоступных кластеров баз данных с использованием Patroni и etcd;
  • Администрирование системы обмена сообщениями RabbitMQ, контроль очередей и доставки;
  • Поддержка интеграций через REST и SOAP API, работа с межведомственным электронным взаимодействием.

4. Мониторинг и документирование:

  • Отслеживание состояния системы через платформы мониторинга (Zabbix, Prometheus, Grafana) и централизованное логирование (GrayLog);
  • Ведение технической документации, инструкций и базы знаний в Confluence, ITSM системе;
  • Подготовка отчетов по выполненным работам и инцидентам

НЕОБХОДИМЫЕ НАВЫКИ:

Для выполнения данного функционала важен ОПЫТ РАБОТЫ:

  • Не менее 5 лет опыта работы системным администратором или инженером DevOps от 3 лет;
  • Не менее 3 лет опыта на позициях L2/L3 технической поддержки с самостоятельным решением инцидентов;
  • Высшее/ среднее-профессиональное техническое образование.

ТЕХНИЧЕСКИЕ НАВЫКИ:

  • Уверенное администрирование Linux (RHEL/CentOS/Ubuntu/Astra Linux);
  • Практический опыт работы с Kubernetes (от 2 лет): управление узлами, Ingress, Services, диагностика проблем;
  • Работа с Docker: контейнеры, образы, Docker Compose;
  • Администрирование PostgreSQL: резервное копирование, восстановление, мониторинг, понимание репликации;
  • Опыт работы с системами виртуализации (VMware vSphere, KVM) и облачными платформами;
  • Настройка и администрирование веб-серверов Nginx (reverse proxy, балансировка нагрузки) и Apache;
  • Работа с системами мониторинга (Zabbix и/или Prometheus+Grafana) и централизованного логирования;
  • Понимание сетевых технологий (TCP/IP, DNS, HTTP/HTTPS), умение диагностировать проблемы на уровне приложений;
  • Базовые навыки работы с RabbitMQ и REST API;
  • SQL на продвинутом уровне (JOIN, агрегатные функции, создание запросов).

ЛИЧНЫЕ КАЧЕСТВА:

  • Способность принимать самостоятельные решения в стрессовых ситуациях;
  • Умение оформлять результаты: кратко фиксировать причины/действия/рекомендации, передавать задачу в L3 с полной диагностикой.

БУДЕТ ПЛЮСОМ:

  • Практический опыт работы с облачной платформой ГЕОП;
  • Опыт эксплуатации государственных информационных систем;
  • Опыт работы со СМЭВ (система межведомственного электронного взаимодействия);
  • Знание Astra Linux и опыт работы в защищенных контурах;
  • Понимание требований 152-ФЗ, 149-ФЗ и базовые знания требований ФСТЭК/ФСБ;
  • Опыт работы с системами автоматизации (Ansible, Puppet, Chef);
  • Знание методологий ITIL/ITSM и опыт работы с системами учета обращений;
  • Опыт построения отказоустойчивых кластеров PostgreSQL с Patroni в продуктивной среде.

УСЛОВИЯ И ГАРАНТИИ:

  • Официальное оформление в аккредитованной IT компании в соответствии с ТК РФ;
  • График работы 2/2 (удаленно/гибрид/ офис на выбор);
  • Программа ДМС со стоматологией;
  • Возможности для карьерного роста;
  • Выплаты социального характера;
  • Возможность дополнительного обучения за счет компании;
  • Уютный офис с зонами отдыха в одном из корпусов Даниловской мануфактуры. Офис расположен в шаговой доступности от м. Тульская (15 мин.) и МЦК Верхние котлы. От ст. Нагатинская 2 остановки на трамвае (8-10 мин).
hh.ru
нпп баум

SRE-инженер

нпп баумНа сервисе с: 25.08.26 18:32↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМоскваГибрид

Мы — группа компаний, успешно объединяющая экспертизу в IT, проектировании и строительстве. Одно из наших ключевых направлений — сопровождение и развитие корпоративной IT-инфраструктуры и информационной безопасности внешних заказчиков.

Сейчас мы развиваем SRE направление, поэтому ищем опытного инженера, который будет проектировать отказоустойчивую архитектуру и выстраивать процессы.

Чем предстоит заниматься:

  • Проектировать и развивать observability: метрики, логи, трейсинг
  • Настраивать осмысленный алертинг — без шума, с приоритизацией по реальному влиянию на сервис
  • Участвовать в расследовании инцидентов, искать фундаментальную причину проблемы, а не только устранять симптом
  • Готовить структурированные разборы инцидентов и предлагать системные меры для предотвращения повторений
  • Взаимодействовать с инженерами и командами проектов, помогая выстраивать единый подход к мониторингу и надёжности

Что для нас важно:

  • Опыт в роли SRE от ~3 лет с опытом именно построения observability, а не только его поддержки
  • Уверенный опыт с Prometheus/Grafana, опыт работы с логированием и трейсингом (Loki и Tempo)
  • Опыт работы с docker, kubernetes
  • Опыт самостоятельного расследования инцидентов и написания post-mortem с фокусом на корневые причины
  • Готовность выстраивать процессы там, где их пока нет, без готовых шаблонов
  • Уверенный опыт с Linux системами, понимание принципов отказоустойчивости (репликация, кластеризация, балансировка, failover)

Будет плюсом:

  • Опыт внедрения SLI/SLO и работы с error budget на практике
  • Навыки автоматизации (Ansible, Python/Bash)

Мы предлагаем:

  • Надёжность: официальное оформление в штат по ТК РФ, ИТ-аккредитация, достойный прозрачный доход и премии по итогам работы

  • Гибридный формат: возможность совмещать работу из дома и офиса

  • Комфорт: современный офис рядом с м. Волгоградский проспект/Пролетарская

  • Оснащение: вся необходимая современная техника и компенсация корпоративной мобильной связи

  • Забота о здоровье: ДМС со стоматологией после испытательного срока

  • Корпоративные скидки: подключение к программе Best Benefits со скидками от партнеров с первого рабочего дня

  • Развитие: возможности для профессионального роста, открытая коммуникация и сильная команда экспертов

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.