S

Senior DevOps Engineer (on-prem K8s)

Местоположение: ЕС, Грузия, Беларусь

symfa · На сервисе с: 30.09.26 22:07

Зарплата не указанаПольшаКипрБеларусьГерманияНидерландыИспанияПортугалияГрузияЧехияЛюксембургЛатвияЛитваЭстонияВенгрияРумынияФинляндияФранцияАвстрияГрецияДанияИталияСловакияУдалёнка

Senior DevOps Engineer (on-prem K8s) Symfa

Местоположение: ЕС, Грузия, Беларусь
Формат работы: Удаленно
Опубликована: ••••••••

Требования:
• Опыт в DevOps от 5 лет
• Сильная экспертиза в on-prem Kubernetes, Ansible и Azure DevOps
• Русский язык C2
• Английский язык B2

Контакт: ••••••••

•••••••• опубликована в ••••••••

Похожие вакансии DevOps

hh.ru
X

Site Reliability Engineer

xsollaНа сервисе с: 26.08.26 18:12↑ Вакансия с автоподнятием
Зарплата не указанаРоссияПермьУдалёнка

Об Xsolla

Xsolla — глобальный лидер в сфере видеоигровой коммерции, предоставляющий разработчикам все возможности для запуска, развития и монетизации игр. Компания поддерживает студии любого масштаба — от инди до AAA — с помощью решений в области Direct-to-Consumer коммерции, интеллектуальных платежей, IP из медиаиндустрии и инструментов вовлечения игроков. Xsolla помогает разработчикам финансировать, распространять, продвигать и монетизировать игры в глобальном масштабе.
Нам доверяют более 70 процентов из топ-100 самых кассовых игр. Xsolla выступает в роли merchant of record в 200+ регионах мира с доступом к более чем 1000 локальных платёжных методов.
Xsolla глубоко верит в будущее игровой индустрии и последовательно объединяет все возможности, открывая путь к росту для разработчиков по всему миру.

О роли

Мы ищем Site Reliability Engineer (SRE) — прагматичного специалиста с продуктовым мышлением, который одинаково уверенно чувствует себя как при написании кода, так и при эксплуатации production-систем, — в SRE-команду департамента Инфраструктуры.

Идеальный кандидат умеет эффективно работать в быстро меняющейся, динамичной среде с высоким уровнем взаимодействия между командами и готов нести ответственность за инфраструктуру на уровне приложений — от CI/CD-пайплайнов и Kubernetes-манифестов до SLO, capacity planning и production readiness.

Для этой роли необходимы сильные навыки в Kubernetes, observability и разработке ПО, а также опыт эксплуатации production-сервисов в облачной среде (GCP/GKE или аналогичной) и тесного взаимодействия с продуктовыми командами разработки.

Ключевым фактором успеха будет способность одновременно понимать обе стороны — как разработчики создают и выпускают новые функциональные возможности и что необходимо инфраструктуре для сохранения высокой надежности — и учитывать требования к надежности уже на ранних этапах проектирования и принятия архитектурных решений.

Если вам интересно превращать сложные распределенные системы в предсказуемые и стабильно работающие платформы и вы хотите развивать commerce- и monetization-инфраструктуру, которая помогает разработчикам игр по всему миру получать доход от своих продуктов, будем рады познакомиться!

Чем вы будете заниматься

  • Отвечать за инфраструктуру на уровне приложений: Helm-чарты, конфигурации Terraform, Kubernetes-деплойменты, runtime-конфигурацию, а также сетевые настройки и интеграции сервисов.

  • Отвечать за observability в рамках продуктового домена: проектировать и внедрять SLO/SLI, мониторы, алерты и дашборды для критичных сервисов с использованием Datadog и инструментов на базе OpenTelemetry.

  • Помогать в создании и развитии CI/CD-пайплайнов для сервисов домена (GitLab CI, GitHub Actions), включая автоматизацию деплоя и отката изменений.

  • Выполнять планирование производительности и емкости инфраструктуры, а также performance tuning перед ожидаемыми пиковыми нагрузками — запусками продуктов, распродажами и региональными релизами. Проводить нагрузочное тестирование и расследовать регрессии производительности.

  • Проводить Production Readiness Review для новых сервисов и значительных изменений; определять и контролировать критерии готовности сервисов домена к эксплуатации в production.

  • Участвовать в реагировании на инциденты в рамках домена: помогать в глубоком расследовании сложных инцидентов, участвовать в подготовке post-mortem, инициировать и доводить до реализации улучшения надежности, а также поддерживать runbook-документацию в актуальном состоянии.

  • Разрабатывать автоматизацию, специфичную для домена и сокращающую объем рутинных операционных задач: автоматизацию runbook-процедур, инструменты для деплоя и регулярные операционные скрипты.

  • Совместно с техническими лидерами продуктовых команд формировать и развивать долгосрочный roadmap по надежности домена.

  • Участвовать в планировании, refinement-сессиях и архитектурных ревью продуктовых команд, обеспечивая учет требований к надежности еще до того, как изменение архитектурных решений станет дорогостоящим.

  • Совместно с основной SRE-командой разрабатывать корпоративные стандарты в области SLO/SLI, capacity planning и эксплуатации; напрямую участвовать в улучшении общих подсистем, находящихся в зоне ответственности SRE.

  • Участвовать в дежурствах SRE-команды, оказывая поддержку разработчикам по всей компании.

Что мы ожидаем

  • От 3 лет подтвержденного опыта работы в роли SRE, DevOps- или Platform Engineer: участие в on-call/реагировании на инциденты, ответственность за SLO и мониторинг, работа с deployment pipelines и инфраструктурой production-сервисов.
  • Опыт разработки ПО: вы не только эксплуатировали системы, но и разрабатывали и выпускали backend-сервисы. Умеете читать и анализировать код приложения при расследовании проблем и писать production-quality автоматизацию как минимум на одном языке программирования, например Go или PHP.
  • Практический опыт работы с Kubernetes: Helm, manifests, стратегии деплоя, диагностика проблем производительности и сетевого взаимодействия на уровне приложений; опыт с GKE или другими managed Kubernetes-платформами.
  • Уверенные знания и практический опыт в observability: создание мониторов, дашбордов и SLO/SLI на современных платформах. Предпочтителен Datadog; опыт с Prometheus/Grafana также релевантен. Знакомство с OpenTelemetry.
  • Опыт работы с Infrastructure as Code (Terraform/Terragrunt), достаточный для эффективного взаимодействия с Platform-командами.
  • Опыт работы с GCP, включая IAM, networking и managed services.
  • Опыт создания и поддержки CI/CD-пайплайнов в GitLab CI и/или GitHub Actions.
  • Уверенные навыки программирования и написания скриптов, достаточные для создания автоматизации и внутренних инструментов, например на Python, Go или Bash.
  • Практический опыт реагирования на инциденты, проведения post-mortem и реализации улучшений надежности по результатам инцидентов.
  • Сильные коммуникативные навыки и умение эффективно работать в команде — эта роль предполагает ежедневную тесную работу с продуктовыми командами разработки.
  • Опыт работы с платежными системами, fintech, e-commerce или gaming-продуктами с высоконагруженными транзакционными системами.

Будет преимуществом

  • Сертификации по Kubernetes.
  • Сертификации Google Cloud Platform.
  • Сертификации HashiCorp.

Что мы предлагаем

  • Развитие и обучение: доступ к внутренней платформе, участие в профессиональных конференциях, хакатонах, митапах и воркшопах
  • Современные инструменты: топовое оборудование (Mac), доступ к продвинутым ИИ-сервисам, которые избавляют от рутины и помогают быть продуктивнее
  • Забота о здоровье: ДМС со стоматологией для вас и членов вашей семьи (супруг, дети), 21 день доплачиваемого до размера зарплаты больничного
  • Глобальные возможности: участие в международных проектах, командировки и потенциальная релокация в один из зарубежных офисов
Если вам откликается эта роль, но вы не уверены, что соответствуете каждому пункту — всё равно напишите. Мы открыты к диалогу и с интересом рассмотрим вашу кандидатуру. Возможно, вы идеально подойдёте именно нам.
Соц.сети
Н

Senior PostgreSQL DBA/SRE (iPaaS, remote, FTE)

Неизвестный работодательНа сервисе с: 30.09.26 20:44
Зарплата не указанаИспанияПортугалияБолгарияУдалёнка

Locations: Spain, Bulgaria, or Portugal (relocation assistance may be provided).

Employment: Full-Time.

About the Company/Product:

  • A global B2B product company developing a powerful Integration Platform as a Service (iPaaS) that uses AI and machine learning to enable organizations to seamlessly connect data sources, cloud applications, and enterprise systems through low-code/no-code automation.
  • The platform is trusted by more than 400,000 customers worldwide, including leading companies such as Visa, Goldman Sachs, Cisco, Amazon, HubSpot, and L’Oréal.
  • The engineering culture emphasizes technical excellence, strong ownership, and close collaboration across globally distributed, remote-first teams.

What You’ll Do:

We are hiring a Senior DBA/SRE to own the health, performance, and day-to-day operations of the PostgreSQL fleet behind the platform. The fleet is ~180 Aurora PostgreSQL clusters across production data centers worldwide. Some databases hold several terabytes, most clusters already run PostgreSQL 17, and the fleet is set to grow to a multiple of its current size. Your responsibilities may include:

  • Keeping the Aurora PostgreSQL fleet healthy across all data centers: building indexes on large and partitioned tables without downtime, analyzing plans, and moving data.
  • Handling Aurora configuration (parameters, replicas, failover, capacity) and cost work: rightsizing, merging low-activity databases, and evaluating serverless.
  • Taking ownership of the PgBouncer layer, which currently needs an owner and a roadmap.
  • Reviewing schemas and data models with product teams, and advising on partitioning, retention, and shared vs. dedicated clusters, backing recommendations with data.
  • Working on the performance of the main application and the search queries behind AI features, including research toward a 10,000 jobs/second target.
  • Packaging the team's existing zero-downtime upgrade and switchover procedures into versioned, released automation, along with provisioning of databases and users, grants, and schema sync across data centers (Terraform, Ansible, GitOps).
  • Deploying tooling for monitoring and managing the PostgreSQL fleet in Kubernetes, and developing monitoring and alerting (exporters, VictoriaMetrics).
  • Handling database incidents end-to-end, including root-cause analysis and follow-up fixes, and taking part in resilience projects: a cross-region DR pilot, application reconnect after failover, and CDC pipelines that survive upgrades and failovers.
  • Contributing to time-boxed evaluations of new database technologies that end with a decision on what the company adopts.
  • Participating in the on-call rotation, with off-rotation time going to uninterrupted project work.

Core Tech Stack: Aurora PostgreSQL, PgBouncer, AWS, Kubernetes, Terraform, Ansible, Linux, VictoriaMetrics, Vault.

What You Have:

  • 5+ years of experience operating PostgreSQL in production (DBA, DBRE, or SRE with a database focus) on databases under real load.
  • Deep experience with database schemas: design, debugging, and troubleshooting performance issues in production.
  • SQL proficiency, query plans, indexing strategy, and performance work on multi-TB tables.
  • Expertise in the ecosystem around PostgreSQL, not only the database itself: streaming and logical replication, HA and failover setups (Patroni or equivalent), connection poolers (PgBouncer), major-version upgrades and migrations with minimal downtime.
  • Linux fundamentals: processes and memory, OOM behavior, networking basics.
  • Scripting skills (Bash, Python, or Go) and an automation-first attitude: you prefer to script a repeated manual task when possible.
  • Readiness to work actively with Kubernetes: deploying tooling for monitoring and managing the PostgreSQL fleet.
  • Strong RCA and incident management skills.
  • Good level of English — at least Upper-intermediate (B2).

Nice-to-Haves:

  • Experience with Infrastructure as Code (Terraform) and cloud infrastructure (AWS, ideally hands-on Aurora or RDS).
  • Experience with different storage systems: ClickHouse (strong plus), OpenSearch, Elasticsearch, Redis, Valkey, MemoryDB, Neo4j.
  • Exposure to Kubernetes basics, GitOps, ArgoCD, or Vault.
  • Contributions to open-source database or infrastructure projects.
  • Openness to using AI assistants in daily work.

What We Offer:

  • Real scale: every database behind a global automation platform, processing billions of events daily.
  • Influence on the stack: your analysis in technology reviews shapes which databases the company adopts.
  • Top-tier engineering team.
  • Competitive base salary + stock options.
  • Fully remote work with flexible hours from Spain, Bulgaria, or Portugal.
  • Possible assistance with relocation to Spain or Bulgaria (visa support & relocation package).
  • Full-time employment with benefits.
  • Health and life insurance.
  • Flexible vacation policy and paid sick leave.
  • Company-provided equipment.
  • Company-sponsored team-bonding activities.
  • Other competitive benefits depending on location (e.g., wellness programs, education budget, referral bonuses, etc.).
Эта вакансия также есть на:Внешний сайт
Соц.сети
Н

DevOps Engineer

Неизвестный работодательНа сервисе с: 30.09.26 19:36
Зарплата не указанаНе указана странаЛокация не указана

Ищу DevOps Engineer в британскую продуктовую компанию. Нужен hands-on DevOps с 5+ годами опыта, уверенным AWS, Terraform, CI/CD, Docker, мониторингом и production infrastructure. Важны свободный английский, самостоятельность и готовность участвовать в on-call. Классный современный телеком продукт, приятная европейская команда и интересные инфраструктурные задачи 🚀

Пишите в личку или в Telegram ••••••••

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.