яндекс

SRE в Поиск

Поиск — первый и ключевой сервис Яндекса. За много лет из простой поисковой программы он развился в высоконагруженную и нетривиальную систему. Поиск большой: им пользуются сотни миллионов пользователей, сотни тысяч ядер обрабатывают миллиа…

яндекс · На сервисе с: 11.08.26 19:43

↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМосква

Поиск — первый и ключевой сервис Яндекса. За много лет из простой поисковой программы он развился в высоконагруженную и нетривиальную систему. Поиск большой: им пользуются сотни миллионов пользователей, сотни тысяч ядер обрабатывают миллиарды запросов в сутки, а некоторые микросервисы держат десятки миллионов RPS, обрабатывая петабайты горячих данных. Такой масштаб и критичность накладывает серьёзные требования на надёжность.

Наша команда работает над всей инфраструктурой основного веб-поиска и поиска по картинкам. Мы ищем SRE, способных внедрять современные SRE-подходы и процессы. Роль SRE — одна из ключевых в продукте.

Автоматизация непрерывной поставки

Вы будете разрабатывать и улучшать механизмы автоматической приёмки и выкатки релизов, минимизируя участие сервисных команд. Это позволит одновременно как повысить надёжность, так и соптимизировать time to market различных внедрений.

Разработка инструментов наблюдаемости

У Поиска из-за большого масштаба много специфичных инструментов для обеспечения наблюдаемости на всех стадиях. Это распределённый трейсинг, инструментарий для анализа инцидентов и так далее. Вам предстоит как использовать эти инструменты, так и развивать их.

Улучшение процессов координации инцидентов

С появлением LLM можно автоматизировать и упростить значительную часть координации инцидентов. Вы будете улучшать процессы починки аварий, упрощать дебаг сложных инцидентов и ускорять починку.

Больше о разработке в Яндексе — в канале Yandex for Developers

* Работали с системами мониторинга и управления конфигурациями
* Уверенно владеете Linux, имеете крепкую ментальную модель разных подсистем
* Понимаете принципы работы TCP/IP и умеете диагностировать сетевые проблемы
* Разбираетесь в построении распределённых и отказоустойчивых веб-сервисов
* Знакомы с подходами Infrastructure as Code
* На хорошем уровне владеете Python или Go

* Разрабатывали на системном языке программирования (в идеале C++)
* Читали SRE book, понимаете принципы SRE
* Понимаете принципы работы очередей и распределённых систем
* Умеете анализировать coredumps
* Уверенно владеете современными подходами к AI в разработке и поддержке

Эта вакансия также есть на:hh.ru

Похожие вакансии DevOps

hh.ru
нпп баум

SRE-инженер

нпп баумНа сервисе с: 25.08.26 18:32↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМоскваГибрид

Мы — группа компаний, успешно объединяющая экспертизу в IT, проектировании и строительстве. Одно из наших ключевых направлений — сопровождение и развитие корпоративной IT-инфраструктуры и информационной безопасности внешних заказчиков.

Сейчас мы развиваем SRE направление, поэтому ищем опытного инженера, который будет проектировать отказоустойчивую архитектуру и выстраивать процессы.

Чем предстоит заниматься:

  • Проектировать и развивать observability: метрики, логи, трейсинг
  • Настраивать осмысленный алертинг — без шума, с приоритизацией по реальному влиянию на сервис
  • Участвовать в расследовании инцидентов, искать фундаментальную причину проблемы, а не только устранять симптом
  • Готовить структурированные разборы инцидентов и предлагать системные меры для предотвращения повторений
  • Взаимодействовать с инженерами и командами проектов, помогая выстраивать единый подход к мониторингу и надёжности

Что для нас важно:

  • Опыт в роли SRE от ~3 лет с опытом именно построения observability, а не только его поддержки
  • Уверенный опыт с Prometheus/Grafana, опыт работы с логированием и трейсингом (Loki и Tempo)
  • Опыт работы с docker, kubernetes
  • Опыт самостоятельного расследования инцидентов и написания post-mortem с фокусом на корневые причины
  • Готовность выстраивать процессы там, где их пока нет, без готовых шаблонов
  • Уверенный опыт с Linux системами, понимание принципов отказоустойчивости (репликация, кластеризация, балансировка, failover)

Будет плюсом:

  • Опыт внедрения SLI/SLO и работы с error budget на практике
  • Навыки автоматизации (Ansible, Python/Bash)

Мы предлагаем:

  • Надёжность: официальное оформление в штат по ТК РФ, ИТ-аккредитация, достойный прозрачный доход и премии по итогам работы

  • Гибридный формат: возможность совмещать работу из дома и офиса

  • Комфорт: современный офис рядом с м. Волгоградский проспект/Пролетарская

  • Оснащение: вся необходимая современная техника и компенсация корпоративной мобильной связи

  • Забота о здоровье: ДМС со стоматологией после испытательного срока

  • Корпоративные скидки: подключение к программе Best Benefits со скидками от партнеров с первого рабочего дня

  • Развитие: возможности для профессионального роста, открытая коммуникация и сильная команда экспертов

hh.ru
до 440k ₽РоссияМоскваУдалёнка

Группа компаний Орбита - ведущий разработчик цифровых решений, российская аккредитованная ИТ-компания

Масштабный технологический проект с глубокой экспертизой в цифровизации бизнеса. Ключевые отрасли: государственный сектор, FinTech, HR Tech, коммуникации и медиа, услуги, рынок недвижимости, travel.

Нам доверяют крупнейшие компании РФ, среди них: Т1, ВТБ, Иннотех, Альфа Банк, ОИС и другие.

Более 6 лет мы ведем собственную продуктовую и заказную разработку высокоэффективных цифровых решений.

Ищем Главный эксперт по кибербезопасности (Information Security Engineer / Anti-DDoS & WAF)

Обязанности:
  • Сопровождать и администрировать системы Web Application Firewall (WAF), комплексы защиты от DDoS-атак и специализированные системы защиты от ботов.
  • Настраивать и оптимизировать политики безопасности на WAF, а также оперативно внедрять правила защиты на Anti-DDoS решениях.
  • Проводить глубокий анализ сетевого трафика для выявления аномалий и реагирования на инциденты.
  • Тестировать, пилотировать и внедрять новые продукты и инструменты информационной безопасности.
Требования:
  • Критично: Опыт работы и сопровождения систем защиты от DDoS-атак на уровнях L4 (Arbor, Митигатор, Периметр) и L7.
  • Опыт противодействия DDoS-атакам на уровне приложения и блокировки вредоносной активности ботов.
  • Практический опыт эксплуатации WAF (Imperva, Solidwall, F5 ASM, PTAF, Webmonitorx или аналогичных).
  • Уверенные навыки администрирования ОС семейства Linux.
  • Опыт работы с сетевыми и контейнерными технологиями: Nginx, HAProxy, Docker, Kubernetes.
  • Понимание архитектуры веб-приложений и опыт их защиты от угроз из списка OWASP Top 10.
  • Глубокие знания сетевых технологий: принципы работы и архитектура корпоративных сетей, механизмы работы TCP-стека, протоколы маршрутизации, понимание узких мест инфраструктуры.
  • Базовые навыки автоматизации: написание скриптов на Python или других языках.
  • Опыт работы со стеком мониторинга: Zabbix, PRTG, Grafana.
Условия:
  • Удаленный формат работы по РФ;
  • Белую заработную плату, оформление согласно Трудовому кодексу РФ;
  • Поддержку: IT-отсрочку и консультации HR/юристов;
  • Прозрачные процессы и открытую коммуникацию;
  • Работу на лучшем оборудовании без логирования времени, с фокусом на доверии и результате;
  • Личный бренд: возможность выступать на конференциях, митапах, публикация статей;
  • Бенефиты: ежеквартальное обновление корпоративных скидок;
  • Движ: организация вечеринок оффлайн и онлайн, предоставление мерча, проведение конкурсов и челленджей.

    Откликайтесь, будем рады познакомиться лично!

Соц.сети
Q

Linux Administrator

quadcodeНа сервисе с: 24.09.26 18:17
Зарплата не указанаКипрLimassolГибрид

#vacancy #cyprus #linux #linuxadmin #devops #infrastructure #limassol #larnaca

🚀 International fintech holding Quadcode is looking for an experienced Linux Administrator to join our Infrastructure team and work with large-scale private cloud infrastructure based on OpenStack and Kubernetes.

Company: Quadcode
Role: Linux Administrator
Level: Senior
Location: Limassol / Larnaca, Cyprus
Work format: Hybrid — 3 days per week from the office

🔥 What you’ll be doing:
• Managing and troubleshooting Linux infrastructure across 2,000+ VMs and 500+ physical servers
• Supporting private cloud environments based on OpenStack and Kubernetes
• Maintaining infrastructure services such as DNS, GitLab, Artifactory, Vault, monitoring and logging
• Handling upgrades, security patches, backups, incidents and root cause analysis
• Automating repetitive operational tasks and improving infrastructure reliability

⚡️ What’s important:
• 5+ years of experience as a Linux Administrator, DevOps Engineer or SRE
• Strong production experience with Linux, Docker and Kubernetes
• Hands-on experience with Ansible, Salt or Chef
• Experience with OpenStack, VMware, Proxmox or public cloud platforms
• Good knowledge of Bash/Python, CI/CD, monitoring and logging
• Experience with Nginx, PostgreSQL/MySQL, Kafka, RabbitMQ or similar infrastructure components
• C1+ Russian and B1+ English

Contact: •••••••• 🙌

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.