G

Senior DevOps / Infrastructure Engineer — high-load DSP

Peaklink — новая мобильная DSP (Demand Side Platform), которая занимается развитием инновационного продукта. Наша цель — создать платформу, которая станет лидером на рынке мобильной рекламы и поможет рекламодателям и издателям достичь новы…

glorytech · На сервисе с: 07.06.26 00:29

до 300k ₽РоссияМоскваОфис

О нас:

Peaklink — новая мобильная DSP (Demand Side Platform), которая занимается развитием инновационного продукта. Наша цель — создать платформу, которая станет лидером на рынке мобильной рекламы и поможет рекламодателям и издателям достичь новых высот.

Почему мы?

  • Возможность поучаствовать в создании нового продукта с нуля и внести свой вклад в его успех.

  • У нас работают профессионалы своего дела, которые всегда готовы поделиться опытом и знаниями.

  • Мы ценим инициативность, креативность и желание развиваться.

  • Мы предоставляем все необходимые ресурсы для работы и профессионального роста.

О роли:

Вы берёте полную ответственность за production-инфраструктуру мобильной DSP (real-time bidding): обеспечиваете её стабильность и полную утилизацию имеющегося оборудования, а затем ведёте масштабирование до 100 000+ RPS. На этой роли нужно создавать прагматичные инженерные решения и балансировать между «надёжность / стоимость». Мы ищем самостоятельного Senior-инженера, который сам ставит и закрывает задачи и понимает систему достаточно глубоко.

Чем предстоит заниматься?

  1. Стабилизация и полная утилизация production. Владение observability (Prometheus / Alertmanager / Grafana / Telegraf / Vector и exporters), проектирование осмысленных метрик и алертов, непрерывный поиск bottleneck и доведение их до устранения — инфраструктурные устраняете сами, по коду ставите точную задачу разработчикам; capacity planning.

  2. Масштабирование RPS на DSP. Рост throughput на текущем bare-metal, ведение архитектурного решения о дальнейшем масштабировании (гибрид k8s + bare-metal).

  3. Эксплуатация и деплой. Развёртывание и конфигурация C++-сервисов в нескольких инстансах, zero-downtime релизы через Ansible playbooks и GitLab CI; бесшовное обновление конфигураций.

  4. Базы данных и брокеры. Эксплуатация и поддержка стабильной работы ClickHouse, MySQL, Kafka, Aerospike.

  5. Внутренняя инфраструктура. Self-managed GitLab, Docker registry, runners; полноценный staging всей системы; движение к zero-trust и единому управлению доступом; резервное копирование и восстановление.

  6. Безопасность. Сетевая сегментация, управление доступом и секретами, TLS.

Что мы от тебя ждем?

  • Глубокое понимание DevOps / CI/CD и уверенная работа с Linux на уровне performance и networking (тюнинг под высокий RPS), а не только администрирования;

  • Observability на уровне владения: Prometheus / Alertmanager / Grafana / Telegraf / Vector и exporters — проектирование метрик и алертов;

  • Performance engineering: поиск bottleneck в high-load сервисах (CPU / IO / network / lock contention), способность отличить инфраструктурную проблему от проблемы в коде;

  • Capacity planning и масштабирование высоконагруженных систем;

  • Ansible (основной IaC-инструмент) и GitLab CI; Docker / Docker Compose в production;

  • Nginx как high-load entrypoint: балансировка, rate-limiting, traffic-shaping, TLS / certbot, graceful reload;

  • Операционный опыт работы с базами данных и брокерами: ClickHouse (MergeTree, partitioning / TTL, multi-disk storage policies, Kafka-engine и materialized views, ZooKeeper, диагностика медленных запросов), MySQL, Kafka, Aerospike;

  • Системное мышление об экономике надёжности: обоснованный выбор, какие компоненты должны быть отказоустойчивыми, а где допустим короткий downtime ради экономии.

Будет преимуществом:

  • Опыт в AdTech / RTB — огромное преимущество (но также релевантен другой latency-sensitive high-load домен с высоким QPS поверх TCP, например fintech или биржевые системы);

  • Владение AI-инструментами разработки (Cursor, Claude Code и аналоги) — большое преимущество;

  • Kubernetes / Nomad в production и готовность обоснованно вести решение о выборе между горизонтальным масштабированием на bare-metal и миграцией в Kubernetes для гибридной системы;

  • Понимание процесса C++ build / release (сборка Docker-образов, версионирование) — для совместной работы с разработчиками;

  • Zero-trust / SSO (Keycloak), netbird; построение корпоративной сети;

  • Airflow / ML-инфраструктура.

Чем эта роль не является

  • Не позиция on-call / поддержки по заявкам — мы ждём автономности и инициативы;

  • Не разработка инфраструктуры с нуля в облаке — это гибридная bare-metal инфраструктура с приоритетом экономической эффективности;

  • Не отказоустойчивость любой ценой — выбор уровня надёжности, оправданного экономически.

Soft Skills

  • Умение брать ответственность на себя и самостоятельно принимать решения;

  • Гибкий подход к решению задач и способность быстро обучаться новым инструментам;

  • Навыки планирования и приоритизации, умение эффективно распределять ресурсы;

  • Коммуникабельность: способность взаимодействовать с разработчиками, менеджерами и другими участниками команды.

Что мы предлагаем:

  • Конкурентный уровень дохода;
  • Гибкая система оплаты, включая зарплату в USD;
  • Минимум бюрократии, максимум автономии и реального влияния на продукт;
  • Возможность расти: участвовать в архитектурных решениях, выбирать инструменты, предлагать улучшения;
  • Работу с современными технологиями в быстроразвивающейся AdTech индустрии;

  • Удаленный формат работы из любой точки мира (при желании - офис в г. Москва).

Похожие вакансии DevOps

hh.ru
bi.zone направление разработка

Инженер систем мониторинга

bi.zone направление разработкаНа сервисе с: 24.09.26 19:18
Зарплата не указанаРоссияМоскваУдалёнка

BI.ZONE создает IT-продукты для обеспечения кибербезопасности: от мобильных приложений до сложных платформ, в основе которых лежат методы машинного обучения. Благодаря нашим решениям жизнь десятков миллионов людей становится лучше и безопаснее.

Сейчас в команду мы ищем инженера аналитика систем мониторинга, который будет развивать системы логирования и мониторинга, администрировать Linux и PostgreSQL, автоматизировать инфраструктуру и выстраивать отказоустойчивые масштабируемые решения.

Чем предстоит заниматься:

  • Развитие систем мониторинга и логирования;
  • Внесение изменений и корректировок в системы мониторинга команды, участие в постановке новых сервисов на мониторинг;
  • Участие в поддержке, оптимизации и развитии инфраструктуры компании;
  • Внедрение и настройка стека технологий мониторинга (Prometheus, Zabbix, Grafana) с учётом требований отказоустойчивости и масштабируемости.
  • Внедрение и настройка стека технологий логирования (VictoriaMetrics, ELK/GrayLog, Syslog) с учётом требований отказоустойчивости и масштабируемости.

Что для нас важно:

  • Глубокие знания, опыт эксплуатации и сопровождения операционных систем семейства Linux (Oracle Linux 8, Debian, Ubuntu);
  • Опыт внедрения и сопровождения IT систем;
  • Опыт развертывания, настройки и администрирования инфраструктурных сервисов (Zabbix, Grafana, Prometheus, ELK, VictoriaMetrics);
  • Знание, опыт работы с PostgreSQL;
  • Опыт работы с платформой виртуализации VMware vSphere(ESXi, vCenter Server)
  • Опыт работы с системами автоматизации инфраструктуры и контроля версий(GitLab, Ansible, Docker, Terraform);
  • Soft-skills: коммуникативность, развитый time-management, инициативность, адаптируемость, а также желание профессионально и карьерно развиваться

Что нам также важно, но можем рассмотреть кандидатов и без этого:

  • Опыт настройки CI/CD систем (GitLab CI/CD);
  • Опыт работы с платформой виртуализации VMware vSphere(ESXi, vCenter Server);
  • Опыт работы с системами автоматизации инфраструктуры и контроля версий(GitLab, Ansible, Docker, Terraform).

Мы предлагаем:

Защищенность Все гарантии официального оформления по ТК РФ и преимущества аккредитованной IT-компании


Сообщества Регулярные профессиональные митапы и встречи для обмена опытом. А также сообщества по интересам: спорт, игры, книги, аниме

Гибкий график
Никто не следит, когда сотрудник садится за компьютер, сколько часов проводит в офисе, как часто работает удаленно

Забота о здоровье ДМС со стоматологией c первого месяца работы в компании

Обучение Сертификация, профильные курсы, конференции, митапы, хакатоны, CTF-ы

Свободная атмосфера У нас на «ты», никакого дресс-кода и лишней бюрократии

Самореализация Поддержка креатива и воплощение идей. Можно профессионально расти и развивать личный бренд

Скидки на фитнес, покупки и многое другое

Скидки от BestBenefits, «Фитмост», «СберПрайм+»и других компаний-партнеров для всех сотрудников

Корпоративная жизнь Крутые внутренние мероприятия и участие в спортивных стартах, а еще мерч и подарки

hh.ru
тантк им.г.м. бериева

Devops инженер

тантк им.г.м. бериеваНа сервисе с: 24.09.26 19:09
55k–70k ₽РоссияТаганрогОфис
Погрузитесь в мир современных технологий и станьте ключевым звеном в организации web серверной архитектуры!

Обязанности
  • Проектирование, развертывание и поддержка серверной инфраструктуры
  • Автоматизация процессов развертывания и мониторинга
  • Обеспечение безопасности и отказоустойчивости систем
  • Оптимизация производительности серверов и приложений
  • Взаимодействие с командами разработки и эксплуатации
Требования
  • Знание Windows/Linux-систем и сетевых технологий
  • Опыт работы с системами автоматизации (Ansible, Terraform и др.)
  • Понимание принципов CI/CD
  • Навыки работы с контейнерами и оркестраторами (Docker, Kubernetes)
  • Умение работать в команде и решать нестандартные задачи
hh.ru
защитаинфотранс, фгуп

Системный администратор инфраструктуры и баз данных ГИС

защитаинфотранс, фгупНа сервисе с: 24.09.26 18:40
Зарплата не указанаРоссияМоскваВладивостокУдалёнка
Локации (удалёнка):МоскваВладивосток

Удалённая работа — географически не привязана. Щёлкни по любой из локаций, чтобы открыть оригинальную карточку.

ФГУП "ЗащитаИнфоТранс" - аккредитованная государственная IT-компания, специализирующаяся на цифровизации и внедрении инноваций в транспортной отрасли, эксперт в области защиты информации и обеспечения транспортной безопасности.

С 1996 года успешно реализовано более 180 масштабных проектов по разработке информационных систем для всей транспортной отрасли.

Приглашаем в команду Ведущего инженера в Отдел эксплуатации инфраструктуры и баз данных Департамента эксплуатации информационных систем.
Работа с государственной информационной системой Электронные перевозочные документы.

Чем предстоит заниматься?

Вы будете центральным звеном технической поддержки системы. Ежедневно вы будете диагностировать и устранять сложные технические проблемы, анализировать метрики и логи, координировать работу с разработчиками и специалистами по информационной безопасности. Вы обеспечите работоспособность контейнеризированных приложений, поддержите интеграции с внешними системами и постоянно актуализируете базу знаний для повышения эффективности команды.

Эта позиция подойдет опытному техническому специалисту, который готов работать с критической государственной инфраструктурой, принимать самостоятельные решения в условиях ограниченного времени и обеспечивать высокий уровень доступности сервисов.

ЗАДАЧИ и ФУНКЦИОНАЛ:

1. Поддержка инцидентов:

  • Прием эскалированных обращений от первой линии поддержки и самостоятельная диагностика сложных технических проблем;
  • Анализ логов и метрик для выявления причин сбоев, применение решений для восстановления работоспособности в рамках SLA;
  • Подготовка полной диагностической информации для передачи на третью линию или производителям при необходимости.

2. Администрирование инфраструктуры и платформ:

  • Управление виртуальной инфраструктурой на облачной платформе ГЕОП (или аналог): жизненный цикл ВМ, базовые сетевые настройки, шаблоны/копии;
  • Администрирование серверов под управлением Linux, администрирование, сервисы ОС, анализ системных журналов;
  • Эксплуатация платформы контейнеризации Kubernetes: управление кластерами, диагностика проблем с приложениями и сервисами;
  • Работа с контейнерами Docker, администрирование веб-серверов Nginx и Apache;

3. Управление базами данных и интеграциями:

  • Администрирование СУБД PostgreSQL: резервное копирование, восстановление, мониторинг производительности и репликации;
  • Поддержка высокодоступных кластеров баз данных с использованием Patroni и etcd;
  • Администрирование системы обмена сообщениями RabbitMQ, контроль очередей и доставки;
  • Поддержка интеграций через REST и SOAP API, работа с межведомственным электронным взаимодействием.

4. Мониторинг и документирование:

  • Отслеживание состояния системы через платформы мониторинга (Zabbix, Prometheus, Grafana) и централизованное логирование (GrayLog);
  • Ведение технической документации, инструкций и базы знаний в Confluence, ITSM системе;
  • Подготовка отчетов по выполненным работам и инцидентам

НЕОБХОДИМЫЕ НАВЫКИ:

Для выполнения данного функционала важен ОПЫТ РАБОТЫ:

  • Не менее 5 лет опыта работы системным администратором или инженером DevOps от 3 лет;
  • Не менее 3 лет опыта на позициях L2/L3 технической поддержки с самостоятельным решением инцидентов;
  • Высшее/ среднее-профессиональное техническое образование.

ТЕХНИЧЕСКИЕ НАВЫКИ:

  • Уверенное администрирование Linux (RHEL/CentOS/Ubuntu/Astra Linux);
  • Практический опыт работы с Kubernetes (от 2 лет): управление узлами, Ingress, Services, диагностика проблем;
  • Работа с Docker: контейнеры, образы, Docker Compose;
  • Администрирование PostgreSQL: резервное копирование, восстановление, мониторинг, понимание репликации;
  • Опыт работы с системами виртуализации (VMware vSphere, KVM) и облачными платформами;
  • Настройка и администрирование веб-серверов Nginx (reverse proxy, балансировка нагрузки) и Apache;
  • Работа с системами мониторинга (Zabbix и/или Prometheus+Grafana) и централизованного логирования;
  • Понимание сетевых технологий (TCP/IP, DNS, HTTP/HTTPS), умение диагностировать проблемы на уровне приложений;
  • Базовые навыки работы с RabbitMQ и REST API;
  • SQL на продвинутом уровне (JOIN, агрегатные функции, создание запросов).

ЛИЧНЫЕ КАЧЕСТВА:

  • Способность принимать самостоятельные решения в стрессовых ситуациях;
  • Умение оформлять результаты: кратко фиксировать причины/действия/рекомендации, передавать задачу в L3 с полной диагностикой.

БУДЕТ ПЛЮСОМ:

  • Практический опыт работы с облачной платформой ГЕОП;
  • Опыт эксплуатации государственных информационных систем;
  • Опыт работы со СМЭВ (система межведомственного электронного взаимодействия);
  • Знание Astra Linux и опыт работы в защищенных контурах;
  • Понимание требований 152-ФЗ, 149-ФЗ и базовые знания требований ФСТЭК/ФСБ;
  • Опыт работы с системами автоматизации (Ansible, Puppet, Chef);
  • Знание методологий ITIL/ITSM и опыт работы с системами учета обращений;
  • Опыт построения отказоустойчивых кластеров PostgreSQL с Patroni в продуктивной среде.

УСЛОВИЯ И ГАРАНТИИ:

  • Официальное оформление в аккредитованной IT компании в соответствии с ТК РФ;
  • График работы 2/2 (удаленно/гибрид/ офис на выбор);
  • Программа ДМС со стоматологией;
  • Возможности для карьерного роста;
  • Выплаты социального характера;
  • Возможность дополнительного обучения за счет компании;
  • Уютный офис с зонами отдыха в одном из корпусов Даниловской мануфактуры. Офис расположен в шаговой доступности от м. Тульская (15 мин.) и МЦК Верхние котлы. От ст. Нагатинская 2 остановки на трамвае (8-10 мин).

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.