koronatech

DevOps-инженер (Python)

Цель команды Devops в нашей компании - это эффективное управление инфраструктурой и процессами, находящимися в нашей зоне ответственности, для обеспечения работоспособности высоконагруженных сервисов 24х7.​​​​​​​

koronatech · На сервисе с: 01.10.26 07:07

Зарплата не указанаРоссияНовосибирскУдалёнка
Цель команды Devops в нашей компании - это эффективное управление инфраструктурой и процессами, находящимися в нашей зоне ответственности, для обеспечения работоспособности высоконагруженных сервисов 24х7.​​​​​​​

Обязанности:
  • Поддержка и развитие систем автоматизированной сборки и доставки приложений
  • Построение и сопровождение процессов CI/CD
  • Обеспечение доставки изменений на тестовые и промышленные среды
  • Поддержка Kubernetes-инфраструктуры и сопутствующих сервисов
  • Анализ, устранение и предотвращение проблем в инфраструктуре и тестовых окружениях
  • Автоматизация инфраструктуры и внутренних процессов
  • Помощь и консультации командам разработки по использованию DevOps-инструментов
  • Участие в развитии инфраструктурной архитектуры
  • Развитие системы мониторинга и реакция на алертинг
Требования:
  • Опыт работы DevOps-инженером от 2 лет
  • Уверенное администрирование Linux
  • Понимание принципов работы сетевого стека TCP/IP
  • Понимание принципов контейнеризации, опыт работы с Docker и написания Dockerfile
  • Опыт работы с Kubernetes и понимание его базовых объектов
  • Опыт работы с системами CI/CD и написанием пайплайнов
  • Понимание принципов Infrastructure as Code и GitOps
  • Практический опыт работы с системами управления конфигурацией (ansible, puppet и т.д.)
  • Опыт работы с Git (ветвление, merge, управление изменениями)
  • Навыки Bash-скриптинга
  • Базовые знания SQL (написание SELECT-запросов)
  • Опыт работы со стеком мониторинга Zabbix, Prometheus, Grafana, alertmanager - настройка мониторингов, алертинга и визуализации метрик
  • Навыки командной работы и коммуникации
Будет плюсом:
  • Опыт работы по Agile / Scrum
  • Опыт администрирования Oracle или PostgreSQL
  • Опыт работы с Helm (написание собственных чартов)
  • Опыт работы с виртуализацией
  • Опыт работы с балансировщиками нагрузки (HAProxy, Nginx, Apache)
  • Понимание сетевых протоколов TLS, BGP
  • Опыт разработки на Go или Python
  • Навыки ведения и поддержания в актуальном состоянии технической документации
  • Написание экспортеров

​​​​​​​​​​​​​​Наш технологический стек:

  • Разработка и управление кодом: GitLab
  • Task-tracking и документация: Jira, Confluence
  • CI/CD: Jenkins, GitLab CI, FluxCD, Helm
  • Платформы: Kubernetes (on-premise), Linux (RHEL, Debian based), Solaris
  • Управление конфигурацией: Puppet, Hashicorp Vault, VMware vSphere
  • Мониторинг: Prometheus, VictoriaMetrics, Grafana, AlertManager
  • Middleware: HAProxy, Apache, Nginx, ELK stack, RabbitMQ, Apache Kafka, ElasticSearch
  • СУБД: Oracle, PostgreSQL
  • Автоматизация и разработка: Bash, Go, Python, Groovy (Jenkins pipelines, Gradle plugins)

Мы предлагаем:

  • Понятная траектория роста (performance review, карьерные консультации, индивидуальная карта развития и т.д.)
  • Обучение и развитие за счёт ресурсов компании (Учебный центр, корпоративная библиотека, оплата внешнего обучения)
  • Социальный пакет (ДМС после испытательного срока, скидки от партнёров, детская программа и т.д.)
  • Насыщенная корпоративная жизнь (радио, подкасты, кибертурнир, собственные мероприятия и участие в крупных событиях отрасли)
  • Возможность быть наставником, автором корпоративного блога, спикером – каждый выбирает то, что подходит именно ему
  • Официальное трудоустройство с первого дня, полностью белая зарплата

Похожие вакансии DevOps

hh.ru
X

Site Reliability Engineer

xsollaНа сервисе с: 26.08.26 18:12↑ Вакансия с автоподнятием
Зарплата не указанаРоссияПермьУдалёнка

Об Xsolla

Xsolla — глобальный лидер в сфере видеоигровой коммерции, предоставляющий разработчикам все возможности для запуска, развития и монетизации игр. Компания поддерживает студии любого масштаба — от инди до AAA — с помощью решений в области Direct-to-Consumer коммерции, интеллектуальных платежей, IP из медиаиндустрии и инструментов вовлечения игроков. Xsolla помогает разработчикам финансировать, распространять, продвигать и монетизировать игры в глобальном масштабе.
Нам доверяют более 70 процентов из топ-100 самых кассовых игр. Xsolla выступает в роли merchant of record в 200+ регионах мира с доступом к более чем 1000 локальных платёжных методов.
Xsolla глубоко верит в будущее игровой индустрии и последовательно объединяет все возможности, открывая путь к росту для разработчиков по всему миру.

О роли

Мы ищем Site Reliability Engineer (SRE) — прагматичного специалиста с продуктовым мышлением, который одинаково уверенно чувствует себя как при написании кода, так и при эксплуатации production-систем, — в SRE-команду департамента Инфраструктуры.

Идеальный кандидат умеет эффективно работать в быстро меняющейся, динамичной среде с высоким уровнем взаимодействия между командами и готов нести ответственность за инфраструктуру на уровне приложений — от CI/CD-пайплайнов и Kubernetes-манифестов до SLO, capacity planning и production readiness.

Для этой роли необходимы сильные навыки в Kubernetes, observability и разработке ПО, а также опыт эксплуатации production-сервисов в облачной среде (GCP/GKE или аналогичной) и тесного взаимодействия с продуктовыми командами разработки.

Ключевым фактором успеха будет способность одновременно понимать обе стороны — как разработчики создают и выпускают новые функциональные возможности и что необходимо инфраструктуре для сохранения высокой надежности — и учитывать требования к надежности уже на ранних этапах проектирования и принятия архитектурных решений.

Если вам интересно превращать сложные распределенные системы в предсказуемые и стабильно работающие платформы и вы хотите развивать commerce- и monetization-инфраструктуру, которая помогает разработчикам игр по всему миру получать доход от своих продуктов, будем рады познакомиться!

Чем вы будете заниматься

  • Отвечать за инфраструктуру на уровне приложений: Helm-чарты, конфигурации Terraform, Kubernetes-деплойменты, runtime-конфигурацию, а также сетевые настройки и интеграции сервисов.

  • Отвечать за observability в рамках продуктового домена: проектировать и внедрять SLO/SLI, мониторы, алерты и дашборды для критичных сервисов с использованием Datadog и инструментов на базе OpenTelemetry.

  • Помогать в создании и развитии CI/CD-пайплайнов для сервисов домена (GitLab CI, GitHub Actions), включая автоматизацию деплоя и отката изменений.

  • Выполнять планирование производительности и емкости инфраструктуры, а также performance tuning перед ожидаемыми пиковыми нагрузками — запусками продуктов, распродажами и региональными релизами. Проводить нагрузочное тестирование и расследовать регрессии производительности.

  • Проводить Production Readiness Review для новых сервисов и значительных изменений; определять и контролировать критерии готовности сервисов домена к эксплуатации в production.

  • Участвовать в реагировании на инциденты в рамках домена: помогать в глубоком расследовании сложных инцидентов, участвовать в подготовке post-mortem, инициировать и доводить до реализации улучшения надежности, а также поддерживать runbook-документацию в актуальном состоянии.

  • Разрабатывать автоматизацию, специфичную для домена и сокращающую объем рутинных операционных задач: автоматизацию runbook-процедур, инструменты для деплоя и регулярные операционные скрипты.

  • Совместно с техническими лидерами продуктовых команд формировать и развивать долгосрочный roadmap по надежности домена.

  • Участвовать в планировании, refinement-сессиях и архитектурных ревью продуктовых команд, обеспечивая учет требований к надежности еще до того, как изменение архитектурных решений станет дорогостоящим.

  • Совместно с основной SRE-командой разрабатывать корпоративные стандарты в области SLO/SLI, capacity planning и эксплуатации; напрямую участвовать в улучшении общих подсистем, находящихся в зоне ответственности SRE.

  • Участвовать в дежурствах SRE-команды, оказывая поддержку разработчикам по всей компании.

Что мы ожидаем

  • От 3 лет подтвержденного опыта работы в роли SRE, DevOps- или Platform Engineer: участие в on-call/реагировании на инциденты, ответственность за SLO и мониторинг, работа с deployment pipelines и инфраструктурой production-сервисов.
  • Опыт разработки ПО: вы не только эксплуатировали системы, но и разрабатывали и выпускали backend-сервисы. Умеете читать и анализировать код приложения при расследовании проблем и писать production-quality автоматизацию как минимум на одном языке программирования, например Go или PHP.
  • Практический опыт работы с Kubernetes: Helm, manifests, стратегии деплоя, диагностика проблем производительности и сетевого взаимодействия на уровне приложений; опыт с GKE или другими managed Kubernetes-платформами.
  • Уверенные знания и практический опыт в observability: создание мониторов, дашбордов и SLO/SLI на современных платформах. Предпочтителен Datadog; опыт с Prometheus/Grafana также релевантен. Знакомство с OpenTelemetry.
  • Опыт работы с Infrastructure as Code (Terraform/Terragrunt), достаточный для эффективного взаимодействия с Platform-командами.
  • Опыт работы с GCP, включая IAM, networking и managed services.
  • Опыт создания и поддержки CI/CD-пайплайнов в GitLab CI и/или GitHub Actions.
  • Уверенные навыки программирования и написания скриптов, достаточные для создания автоматизации и внутренних инструментов, например на Python, Go или Bash.
  • Практический опыт реагирования на инциденты, проведения post-mortem и реализации улучшений надежности по результатам инцидентов.
  • Сильные коммуникативные навыки и умение эффективно работать в команде — эта роль предполагает ежедневную тесную работу с продуктовыми командами разработки.
  • Опыт работы с платежными системами, fintech, e-commerce или gaming-продуктами с высоконагруженными транзакционными системами.

Будет преимуществом

  • Сертификации по Kubernetes.
  • Сертификации Google Cloud Platform.
  • Сертификации HashiCorp.

Что мы предлагаем

  • Развитие и обучение: доступ к внутренней платформе, участие в профессиональных конференциях, хакатонах, митапах и воркшопах
  • Современные инструменты: топовое оборудование (Mac), доступ к продвинутым ИИ-сервисам, которые избавляют от рутины и помогают быть продуктивнее
  • Забота о здоровье: ДМС со стоматологией для вас и членов вашей семьи (супруг, дети), 21 день доплачиваемого до размера зарплаты больничного
  • Глобальные возможности: участие в международных проектах, командировки и потенциальная релокация в один из зарубежных офисов
Если вам откликается эта роль, но вы не уверены, что соответствуете каждому пункту — всё равно напишите. Мы открыты к диалогу и с интересом рассмотрим вашу кандидатуру. Возможно, вы идеально подойдёте именно нам.
Соц.сети
Н

Senior PostgreSQL DBA/SRE (iPaaS, remote, FTE)

Неизвестный работодательНа сервисе с: 30.09.26 20:44
Зарплата не указанаИспанияПортугалияБолгарияУдалёнка

Locations: Spain, Bulgaria, or Portugal (relocation assistance may be provided).

Employment: Full-Time.

About the Company/Product:

  • A global B2B product company developing a powerful Integration Platform as a Service (iPaaS) that uses AI and machine learning to enable organizations to seamlessly connect data sources, cloud applications, and enterprise systems through low-code/no-code automation.
  • The platform is trusted by more than 400,000 customers worldwide, including leading companies such as Visa, Goldman Sachs, Cisco, Amazon, HubSpot, and L’Oréal.
  • The engineering culture emphasizes technical excellence, strong ownership, and close collaboration across globally distributed, remote-first teams.

What You’ll Do:

We are hiring a Senior DBA/SRE to own the health, performance, and day-to-day operations of the PostgreSQL fleet behind the platform. The fleet is ~180 Aurora PostgreSQL clusters across production data centers worldwide. Some databases hold several terabytes, most clusters already run PostgreSQL 17, and the fleet is set to grow to a multiple of its current size. Your responsibilities may include:

  • Keeping the Aurora PostgreSQL fleet healthy across all data centers: building indexes on large and partitioned tables without downtime, analyzing plans, and moving data.
  • Handling Aurora configuration (parameters, replicas, failover, capacity) and cost work: rightsizing, merging low-activity databases, and evaluating serverless.
  • Taking ownership of the PgBouncer layer, which currently needs an owner and a roadmap.
  • Reviewing schemas and data models with product teams, and advising on partitioning, retention, and shared vs. dedicated clusters, backing recommendations with data.
  • Working on the performance of the main application and the search queries behind AI features, including research toward a 10,000 jobs/second target.
  • Packaging the team's existing zero-downtime upgrade and switchover procedures into versioned, released automation, along with provisioning of databases and users, grants, and schema sync across data centers (Terraform, Ansible, GitOps).
  • Deploying tooling for monitoring and managing the PostgreSQL fleet in Kubernetes, and developing monitoring and alerting (exporters, VictoriaMetrics).
  • Handling database incidents end-to-end, including root-cause analysis and follow-up fixes, and taking part in resilience projects: a cross-region DR pilot, application reconnect after failover, and CDC pipelines that survive upgrades and failovers.
  • Contributing to time-boxed evaluations of new database technologies that end with a decision on what the company adopts.
  • Participating in the on-call rotation, with off-rotation time going to uninterrupted project work.

Core Tech Stack: Aurora PostgreSQL, PgBouncer, AWS, Kubernetes, Terraform, Ansible, Linux, VictoriaMetrics, Vault.

What You Have:

  • 5+ years of experience operating PostgreSQL in production (DBA, DBRE, or SRE with a database focus) on databases under real load.
  • Deep experience with database schemas: design, debugging, and troubleshooting performance issues in production.
  • SQL proficiency, query plans, indexing strategy, and performance work on multi-TB tables.
  • Expertise in the ecosystem around PostgreSQL, not only the database itself: streaming and logical replication, HA and failover setups (Patroni or equivalent), connection poolers (PgBouncer), major-version upgrades and migrations with minimal downtime.
  • Linux fundamentals: processes and memory, OOM behavior, networking basics.
  • Scripting skills (Bash, Python, or Go) and an automation-first attitude: you prefer to script a repeated manual task when possible.
  • Readiness to work actively with Kubernetes: deploying tooling for monitoring and managing the PostgreSQL fleet.
  • Strong RCA and incident management skills.
  • Good level of English — at least Upper-intermediate (B2).

Nice-to-Haves:

  • Experience with Infrastructure as Code (Terraform) and cloud infrastructure (AWS, ideally hands-on Aurora or RDS).
  • Experience with different storage systems: ClickHouse (strong plus), OpenSearch, Elasticsearch, Redis, Valkey, MemoryDB, Neo4j.
  • Exposure to Kubernetes basics, GitOps, ArgoCD, or Vault.
  • Contributions to open-source database or infrastructure projects.
  • Openness to using AI assistants in daily work.

What We Offer:

  • Real scale: every database behind a global automation platform, processing billions of events daily.
  • Influence on the stack: your analysis in technology reviews shapes which databases the company adopts.
  • Top-tier engineering team.
  • Competitive base salary + stock options.
  • Fully remote work with flexible hours from Spain, Bulgaria, or Portugal.
  • Possible assistance with relocation to Spain or Bulgaria (visa support & relocation package).
  • Full-time employment with benefits.
  • Health and life insurance.
  • Flexible vacation policy and paid sick leave.
  • Company-provided equipment.
  • Company-sponsored team-bonding activities.
  • Other competitive benefits depending on location (e.g., wellness programs, education budget, referral bonuses, etc.).
Эта вакансия также есть на:Внешний сайт
hh.ru
К

DevSecOps / Platform Security инженер

киберсистемаНа сервисе с: 01.10.26 08:09
Зарплата не указанаРоссияМоскваУдалёнка
Обязанности:
  • Проектирование, эксплуатация и аудит CI/CD на GitLab/GitHub/Jenkins или аналогичных платформах.
  • Администрирование и security review Kubernetes/containers: RBAC, admission, secrets, network policies, registries, runtime security и hardening.
  • Управление секретами: Vault и аналоги, токены, API keys, machine identities, rotation, short-lived credentials.
  • IaC: Terraform/Ansible/Helm, контроль изменений, state, cloud credentials и security review конфигураций.
  • Внедрение и оценка security gates: SAST, SCA, DAST, secret scanning, container/IaC scanning, SBOM, image signing и policy-as-code.
  • Анализ software supply chain: репозитории, runners/agents, artifact repositories, registries, webhooks, deploy keys и внешние зависимости.
  • Участие в построении SSDLC, threat modeling и process gates для разработки.
  • Аудит GitLab/Jenkins/Vault/Artifactory/Kubernetes/Cloud control plane и административных ролей.
  • Участие в расследованиях компрометации CI/CD, утечек секретов, несанкционированных изменений и supply-chain атак.
  • Поддержка внедрения отечественных/локальных инструментов DevSecOps и интеграции с SIEM/SOC.
  • Подготовка runbook, архитектуры, схем доверия, требований к hardening и технических рекомендаций.
Обязательные требования:
  • Опыт DevOps/DevSecOps/Platform Engineering от 4-5 лет в production.
  • Глубокое знание GitLab/GitHub, Jenkins или аналогичных CI/CD платформ.
  • Практический опыт Kubernetes, container runtime, Helm, registry и RBAC.
  • Опыт Vault или сопоставимых secret management решений.
  • Практический опыт Terraform/IaC и cloud credentials.
  • Понимание software supply chain security, secret leakage, artifact integrity и CI/CD attack paths.
  • Опыт SAST/SCA/DAST, secret scanning, container/IaC scanning.
  • Умение анализировать YAML, pipeline scripts, Terraform, Dockerfile, Helm и конфигурации платформ.
  • Понимание cloud IAM и механизмов федерации/машинных учетных записей.
  • Умение документировать архитектуру и формулировать технические риски.

Будет преимуществом:

  • Опыт AppSec или web/API pentest.
  • Опыт Falco, StackRox/RHACS, Trivy, Kubescape или аналогичных инструментов.
  • SBOM, Cosign/Sigstore, provenance, SLSA и policy-as-code.
  • Опыт Yandex Cloud, Cloud.ru, Kubernetes-платформ российских вендоров.
  • CKA/CKS, GitLab, HashiCorp или cloud security сертификации.
Мы предлагаем:
  • Гибридный, удаленный или офисный формат работы — по договоренности.
  • Официальное трудоустройство по ТК РФ.
  • Сложные и интересные задачи по выстраиванию безопасности с нуля или развитию текущей архитектуры у заказчиков.
  • Профессиональный и карьерный рост в команде технических экспертов.

Личные качества:

  • Системность и аккуратность.
  • Умение доводить задачи до результата.
  • Способность спокойно работать с авариями и приоритетными инцидентами.
  • Умение объяснять технические вопросы понятным языком.
  • Готовность самостоятельно разбираться в новых технологиях.

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.