ventra

SRE & DevOps Lead / Руководитель группы автоматизации и управления инфраструктуры

Мы в Ventra Go! создаём маркетплейс подработок, где люди находят задания, выполняют их и получают быстрые выплаты. Наш сервис помогает компаниям оперативно закрывать кадровые потребности, а исполнителям — зарабатывать удобным способом. Сей…

ventra На сервисе с: 06.10.26 18:33

Зарплата не указанаРоссияМоскваГибрид

Мы в Ventra Go! создаём маркетплейс подработок, где люди находят задания, выполняют их и получают быстрые выплаты. Наш сервис помогает компаниям оперативно закрывать кадровые потребности, а исполнителям — зарабатывать удобным способом. Сейчас мы находимся в поиске SRE / DevOps Lead, который возглавит команду платформенной инженерии, выстроит системный SRE-подход и обеспечит надежность, масштабируемость и наблюдаемость продуктовой платформы Ventra Go! в условиях активного роста бизнеса и развития Data/ML-направлений.

Чем предстоит заниматься:

  • Лидировать команду SRE / DevOps инженеров (2–5 человек, подрядчики): постановка целей, 1:1, performance review, найм, онбординг и развитие технических компетенций;

  • Формировать и развивать SRE-практики: внедрение SLI / SLO / SLA, управление error budgets, мониторинг сквозных бизнес-процессов (BPO);

  • Проектировать и развивать observability-платформу (метрики, логи, трейсинг, алерты, дашборды, плейбуки) для сервисов, инфраструктуры и Data/ML-контуров;

  • Организовывать процессы Incident Management: on-call дежурства, координация war-rooms, проведение blameless postmortem, контроль выполнения action items;

  • Выявлять и устранять скрытые деградации систем без явных аварий (рост latency, saturation, узкие места емкости);

  • Развивать и поддерживать Kubernetes-платформу: кластеры, сетевая связность, RBAC, ingress, autoscaling, secrets management, multi-environment (dev / stage / prod);

  • Разрабатывать и развивать Infrastructure as Code и GitOps (Terraform, Helm), внедрять единые platform guardrails и стандарты деплоя для продуктовых команд;

  • Выстраивать надежные CI/CD и релизные пайплайны (canary, blue-green, zero-downtime, feature flags) для backend, mobile, frontend и data/ML;

  • Обеспечивать стабильную эксплуатацию платформенных решений: Kafka, PostgreSQL, Redis, ClickHouse, OpenSearch, Trino, Spark, Iceberg;

  • Проводить capacity planning с учетом роста нагрузки и сезонности, оптимизировать инфраструктурные расходы (FinOps);

  • Проектировать и тестировать сценарии Disaster Recovery и Business Continuity (RTO / RPO);

  • Участвовать в архитектурных комитетах и ADR с правом вето на решения с неприемлемым операционным риском;

  • Взаимодействовать с продуктовыми и функциональными командами как партнер по надежности.

Наш стек: Kubernetes, Docker, Helm, Terraform, GitOps, Linux, PostgreSQL, Redis, Apache Kafka, ClickHouse, OpenSearch, Trino, Apache Spark, Apache Iceberg, Prometheus, Grafana, OpenTelemetry, CI/CD.

Что мы ожидаем:

  • 5+ лет опыта в сфере DevOps / SRE / Platform Engineering и 2+ года в роли Team Lead / Tech Lead;

  • Практический опыт промышленной эксплуатации Kubernetes под высокими нагрузками (сеть, ingress, autoscaling, RBAC, управление секретами);

  • Глубокое понимание Linux, сетевого стека (TCP/IP, DNS, маршрутизация, балансировка нагрузки) и микросервисной архитектуры;

  • Опыт построения комплексных систем мониторинга и трейсинга, практическое понимание SRE-методологии (SLI/SLO, error budgets, postmortem);

  • Опыт администрирования и обеспечения отказоустойчивости хранилищ и брокеров: Kafka, PostgreSQL, Redis, ClickHouse, OpenSearch;

  • Уверенное владение IaC (Terraform) и GitOps-инструментами, опыт выстраивания релизных пайплайнов со стратегиями безаварийного деплоя;

  • Опыт управления инцидентами, построения дежурств (on-call) и проведения анализа первопричин (RCA);

  • Понимание принципов FinOps (учет и оптимизация TCO инфраструктуры), практик DevSecOps и обеспечения Disaster Recovery (RTO/RPO);

  • Будет плюсом: опыт поддержки и оптимизации data/streaming/ML-стека (Spark, Trino, Iceberg).

Что мы предлагаем:

  • Достойную заработную плату и прозрачную систему мотивации.

  • Мягкий гибридный формат работы (3 дня офис, 2 дня дома).

  • Официальное оформление по ТК РФ.

  • Социальные программы (ДМС, оплата больничного, программы матпомощи, обучения и др.).

  • Корпоративный доступ к образовательным платформам.

  • Программу корпоративных привилегий PrimeZone.

  • Возможность выстраивать архитектуру надежности и инженерную культуру платформы с прямым влиянием на бизнес.

Понравилась наша вакансия? Оставляйте отклик, будем рады рассказать о нашем продукте подробнее :)

Похожие вакансии DevOps

Соц.сети
T

Middle DevOps Engineer

tbc_uzbekistanНа сервисе с: 06.10.26 19:24
Зарплата не указанаУзбекистанГрузияТбилисиГибрид

Middle DevOps Engineer
TBC Uzbekistan is a digital financial services ecosystem powering some of the country's most innovative financial experiences.
Hybrid (Tbilisi, Tashkent).
••••••••
More details in Teona Khmaladze's ••••••••.

hh.ru
Ф

Infrastructure Lead

фокскодНа сервисе с: 06.10.26 19:15
Зарплата не указанаРоссияСанкт-ПетербургУдалёнка
Продуктовая IT-компания. Делаем B2C-сервисы на базе AI, которыми пользуются люди в России, СНГ и за рубежом. Создаем веб-приложения и зарабатываем на подписке.​​​​​​​
Ищем сильного инженера с опытом управления небольшой командой, который возьмёт на себя инфраструктуру, надёжность, наблюдаемость и безопасность компании.
Это роль играющего тренера: около 60–70% времени предстоит работать руками, остальное — управлять командой из 2–3 человек, планировать развитие инфраструктуры и взаимодействовать с бизнесом. Подчинение напрямую генеральному директору, ключевой партнёр — CTO.
Задачи:
  • Обеспечивать стабильность bare-metal серверов, виртуализации, сетей, PostgreSQL, RabbitMQ и S3-хранилищ.
  • Развивать мониторинг, логирование, трейсинг, алертинг и on-call.
  • Управлять инцидентами, проводить постмортемы и учения по восстановлению.
  • Отвечать за бэкапы, репликацию, DR-планы и регулярную проверку восстановления.
  • Управлять доступами, секретами, VPN, патчами и инфраструктурной безопасностью.
  • Автоматизировать инфраструктуру с помощью Ansible, Terraform и скриптов.
  • Поддерживать GitLab, CI-раннеры, SSO, wiki и другие внутренние сервисы.
  • Планировать мощности, бюджет и работу с провайдерами и подрядчиками.
  • Руководить небольшой командой: ставить задачи, развивать сотрудников и не становиться единственной точкой отказа.
  • Формировать требования к эксплуатации сервисов и договариваться с разработкой об их реализации.
Что важно:
  • От 6 лет опыта в эксплуатации и инфраструктуре.
  • От 1–2 лет руководства небольшой инженерной командой.
  • Глубокое знание Linux, сетей и диагностики производительности.
  • Практический опыт с bare-metal, RAID, IPMI и виртуализацией — Proxmox, KVM или VMware. Опыт только с облаками не подойдёт.
  • Эксплуатация PostgreSQL: репликация, PITR, Patroni или аналоги, pgBackRest/WAL-G, анализ производительности.
  • Работа с RabbitMQ и S3-совместимыми хранилищами.
  • Prometheus, Grafana, Loki/Alloy или аналогичный стек наблюдаемости.
  • Ansible обязательно, Terraform желательно.
  • Docker и docker compose; понимание, когда Kubernetes действительно нужен.
  • Vault, SSO/LDAP, принцип минимальных привилегий и аудит доступов.
  • Bash и Python или Go.
  • Понимание эксплуатации PHP/Laravel: php-fpm, OPcache, воркеры и типичные узкие места.
  • Способность спокойно действовать во время инцидентов и объяснять технические риски на языке денег и последствий.
Работа с AI
AI-ассистенты — обязательная часть инженерной практики. Ожидаем ежедневное использование Claude Code, Cursor или аналогов для работы с IaC, скриптами, логами, runbook’ами и постмортемами.
Важно уметь внедрять AI-сценарии в процессы команды, критически проверять результат и понимать ограничения безопасности: какие данные можно передавать моделям и какой доступ допустимо давать агентам.

Будет плюсом:
  • Опыт аудитов ИБ, PCI DSS, требований ЦБ, ФСТЭК и 152-ФЗ.
  • Работа с SIEM, IDS и WAF.
  • Миграция между дата-центрами без простоя.
  • FinOps и оптимизация инфраструктурных расходов.
Мы предлагаем:
  • Оклад и квартальная премия, детальнее обсуждаем на собеседовании
  • Самописная аналитическая система в реальном времени — все показатели по всем кампаниям, без выгрузок и ожидания отчётов
  • Доступ к корпоративному Claude и другим ИИ-ассистентам — без лимитов и заявок
  • Предоставляем сервисы, необходимые для работы — аналитика, парсеры, подписки, доступы к профильным платформам
  • Быстрые согласования гипотез и большой простор для тестирования — идея проверяется, а не защищается месяцами
  • ДМС — после года сотрудничества
  • Оплачиваемый отгул — 28 дней в год
  • Day-off — 1 день в месяц без отработки
  • Команда ~ 35 человек, полностью распределённая — работаем на результат, а не на присутствие в календаре
hh.ru
Зарплата не указанаРоссияМоскваУдалёнка

Мы LAB – аккредитованная ИТ-компания, являющаяся Fintech/ Insuretech подразделением Агентства страховых технологий. Уже более 5 лет мы выпускаем IT продукты, меняющие мир авто и имущественного страхования.

Наша команда быстро растет и мы приглашаем в команду настоящих профессионалов, способных вместе с нами делать прорывные SAAS решения!

ПРОЕКТЫ связаны с развитием внутренних продуктов:

FAST – агрегатор финансовых продуктов, B2B CRM-система, которая позволяет сравнивать предложения от страховых компаний и оформлять продукты в режиме одного окна.

FAST.Авто – агрегатор финансовых продуктов, CRM-система отдела кредитования и страхования автодилера;

FAST.Ипотека – агрегатор программ ипотечного страхования для отделов продаж в сегменте жилой недвижимости.

Ищем инженера, который:

* администрирует Linux и умеет диагностировать проблемы на уровне ОС, сети, памяти, диска;

* эксплуатирует Docker Swarm: стеки, сервисы, rolling update, rollback, healthcheck, лимиты ресурсов - для него не просто слова;

* понимает пайплайны в GitLab CI;

* пишет скрипты и внутренние инструменты диагностики;

* спокойно работает с легаси и постепенно автоматизирует рутину.

Обязательные требования

1. Linux:

* systemd, процессы, сигналы, логи, journald.

* Сеть: TCP/IP, DNS, HTTP/HTTPS, TLS, iptables/nftables, диагностика подключений.

* Память: cgroups, OOM, лимиты, swap

* Диски: LVM, файловые системы, inode, I/O, место.

* Bash на уровне написания простых скриптов и понимания уже написанных

2. Docker и Docker Swarm:

* Dockerfile, docker-compose, стеки, слои докера

* Swarm services, stacks, overlay networks, secrets, configs

* Rolling update, rollback, healthcheck, update-order, delay.

* Resource limits: --limit-memory, --reserve-memory, CPU limits, понимание OOM в Swarm.

* Placement constraints, labels, режимы replicated/global.

Диагностика Swarm: docker service logs, docker node ps, docker inspect, события.

Понимание ограничений Swarm и почему в будущем может понадобиться K8s, но без требования K8s сейчас.

3. GitLab CI/CD:

* Пайплайны: stages, jobs, rules, needs, artifacts, cache, environments.

* Переменные, protected branches, runners, теги.

* Деплой в Docker Swarm из GitLab CI.

* Работа с GitLab Registry.

4. Автоматизация и скрипты:

Bash + Go (если опыта нет, то нужно большое желание его изучить и опыт в других языках).

Работа с API, парсинг, интеграции.

Внутренние инструменты: диагностика подключений, проверки DNS/TCP/TLS/HTTP.

5. Мониторинг и логирование:

* Prometheus, Grafana

* Сбор логов: OpenSearch, vector/etc

* Алерты, дашборды, диагностика по метрикам.

* Понимание, как мониторить Docker Swarm, MySQL, Linux, etc.

Будет плюсом:

* Опыт миграций БД.

* Опыт написания внутренних DevOps-инструментов.

* S3(любой), nginx, ansible

У НАС ТЫ СМОЖЕШЬ НАЙТИ:

  • Возможность работать из любой страны;
  • Работу в аккредитованной IT-компании;
  • Выбор формата сотрудничества – ТК РФ, Договор ГПХ, Самозанятость;
  • Социальный пакет:
  • Расширенная программа ДМС в твоем регионе со стоматологической помощью, услугой по экстренной госпитализации в любом регионе РФ и онкострахованием с лечением в России,
  • Возможность застраховать своих близких по корпоративным тарифам по программам «ДМС» и «НС»,
  • Материальная помощь;
  • Корпоративное обучение и развитие;
  • Работа в команде профессионалов в доброжелательной атмосфере;
  • Амбициозные задачи и проекты, возможность внести ощутимый вклад в развитие IT инфраструктуры на рынке страхования, создавая инновационные продукты;
  • Работу в команде, где четко разделены зоны ответственности. Внутри нашей структуры мы формируем продуктовые команды, состоящие из PM, Аналитиков, Backend, Frontend, QA специалистов, UX дизайнеров и Devops;
  • Скидки для сотрудников от наших партнеров.

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.