Местоположение: ЕС, Грузия, Беларусь
symfa · На сервисе с: 30.09.26 22:07
Senior DevOps Engineer (on-prem K8s) Symfa
Местоположение: ЕС, Грузия, Беларусь
Формат работы: Удаленно
Опубликована: ••••••••
Требования:
• Опыт в DevOps от 5 лет
• Сильная экспертиза в on-prem Kubernetes, Ansible и Azure DevOps
• Русский язык C2
• Английский язык B2
Контакт: ••••••••
•••••••• опубликована в ••••••••
Мы ищем Site Reliability Engineer (SRE) — прагматичного специалиста с продуктовым мышлением, который одинаково уверенно чувствует себя как при написании кода, так и при эксплуатации production-систем, — в SRE-команду департамента Инфраструктуры.
Идеальный кандидат умеет эффективно работать в быстро меняющейся, динамичной среде с высоким уровнем взаимодействия между командами и готов нести ответственность за инфраструктуру на уровне приложений — от CI/CD-пайплайнов и Kubernetes-манифестов до SLO, capacity planning и production readiness.
Для этой роли необходимы сильные навыки в Kubernetes, observability и разработке ПО, а также опыт эксплуатации production-сервисов в облачной среде (GCP/GKE или аналогичной) и тесного взаимодействия с продуктовыми командами разработки.
Ключевым фактором успеха будет способность одновременно понимать обе стороны — как разработчики создают и выпускают новые функциональные возможности и что необходимо инфраструктуре для сохранения высокой надежности — и учитывать требования к надежности уже на ранних этапах проектирования и принятия архитектурных решений.
Если вам интересно превращать сложные распределенные системы в предсказуемые и стабильно работающие платформы и вы хотите развивать commerce- и monetization-инфраструктуру, которая помогает разработчикам игр по всему миру получать доход от своих продуктов, будем рады познакомиться!
Отвечать за инфраструктуру на уровне приложений: Helm-чарты, конфигурации Terraform, Kubernetes-деплойменты, runtime-конфигурацию, а также сетевые настройки и интеграции сервисов.
Отвечать за observability в рамках продуктового домена: проектировать и внедрять SLO/SLI, мониторы, алерты и дашборды для критичных сервисов с использованием Datadog и инструментов на базе OpenTelemetry.
Помогать в создании и развитии CI/CD-пайплайнов для сервисов домена (GitLab CI, GitHub Actions), включая автоматизацию деплоя и отката изменений.
Выполнять планирование производительности и емкости инфраструктуры, а также performance tuning перед ожидаемыми пиковыми нагрузками — запусками продуктов, распродажами и региональными релизами. Проводить нагрузочное тестирование и расследовать регрессии производительности.
Проводить Production Readiness Review для новых сервисов и значительных изменений; определять и контролировать критерии готовности сервисов домена к эксплуатации в production.
Участвовать в реагировании на инциденты в рамках домена: помогать в глубоком расследовании сложных инцидентов, участвовать в подготовке post-mortem, инициировать и доводить до реализации улучшения надежности, а также поддерживать runbook-документацию в актуальном состоянии.
Разрабатывать автоматизацию, специфичную для домена и сокращающую объем рутинных операционных задач: автоматизацию runbook-процедур, инструменты для деплоя и регулярные операционные скрипты.
Совместно с техническими лидерами продуктовых команд формировать и развивать долгосрочный roadmap по надежности домена.
Участвовать в планировании, refinement-сессиях и архитектурных ревью продуктовых команд, обеспечивая учет требований к надежности еще до того, как изменение архитектурных решений станет дорогостоящим.
Совместно с основной SRE-командой разрабатывать корпоративные стандарты в области SLO/SLI, capacity planning и эксплуатации; напрямую участвовать в улучшении общих подсистем, находящихся в зоне ответственности SRE.
Участвовать в дежурствах SRE-команды, оказывая поддержку разработчикам по всей компании.
Будет преимуществом
Locations: Spain, Bulgaria, or Portugal (relocation assistance may be provided).
Employment: Full-Time.
We are hiring a Senior DBA/SRE to own the health, performance, and day-to-day operations of the PostgreSQL fleet behind the platform. The fleet is ~180 Aurora PostgreSQL clusters across production data centers worldwide. Some databases hold several terabytes, most clusters already run PostgreSQL 17, and the fleet is set to grow to a multiple of its current size. Your responsibilities may include:
Core Tech Stack: Aurora PostgreSQL, PgBouncer, AWS, Kubernetes, Terraform, Ansible, Linux, VictoriaMetrics, Vault.
Ищу DevOps Engineer в британскую продуктовую компанию. Нужен hands-on DevOps с 5+ годами опыта, уверенным AWS, Terraform, CI/CD, Docker, мониторингом и production infrastructure. Важны свободный английский, самостоятельность и готовность участвовать в on-call. Классный современный телеком продукт, приятная европейская команда и интересные инфраструктурные задачи 🚀
Пишите в личку или в Telegram ••••••••
HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.