Основная задача - развивать надёжную и безопасную инженерную платформу для банковских продуктов.
Обязанности: - Проектирование, автоматизация и сопровождение отказоустойчивой инфраструктуры банковских продуктов, включая среды, CI/CD, Infrastructure as Code, наблюдаемость, безопасность, резервирование и восстановление.
- Создание self-service инструментов, позволяющих разработчикам самостоятельно собирать, тестировать, развёртывать и диагностировать сервисы в пределах согласованных ограничений.
- Обеспечение производительности и масштабируемости платформы, участие в нагрузочном тестировании и устранении инфраструктурных узких мест.
- Развитие метрик, логов, трассировки и оповещений; участие в разборе инцидентов и устранении их системных причин.
- Автоматизация управления конфигурациями, секретами, доступами и требованиями безопасности.
- Поддержание эксплуатационной документации и проверенных процедур развёртывания, отката и восстановления.
Требования: - Опыт построения и промышленной эксплуатации инфраструктуры высоконагруженных систем с высокими требованиями к доступности и восстановлению после сбоев.
- Практический опыт построения CI/CD и автоматизации полного цикла поставки изменений.
- Опыт контейнеризации и оркестрации приложений, включая Docker и Kubernetes или сопоставимые технологии.
- Опыт управления инфраструктурой и конфигурациями с использованием Infrastructure as Code (IaC);
- Уверенное знание Linux, сетевого взаимодействия, DNS, балансировки нагрузки, TLS и базовых механизмов безопасности.
- Опыт построения наблюдаемости: метрики, централизованные логи, распределённая трассировка, dashboards и alerts.
- Понимание отказоустойчивости, резервного копирования, disaster recovery и принципов эксплуатации критичных сервисов.
- Опыт безопасного управления секретами, сервисными учётными записями и доступами.
- Навыки автоматизации на Bash, Python или другом скриптовом языке.
- Опыт AI-assisted работы: использование coding agents для подготовки и анализа IaC, pipeline-конфигураций, скриптов, диагностики и документации с обязательной инженерной проверкой результата.
- Опыт эксплуатации банковских, платёжных или других регулируемых систем.
- Опыт работы с высоконагруженными Java-сервисами и диагностики JVM.
- Опыт эксплуатации Kafka, PostgreSQL, Redis и других компонентов распределённых систем.
- Практика формализации SLI/SLO, error budgets и capacity planning.
- Опыт нагрузочного тестирования и анализа производительности всей цепочки от приложения до инфраструктуры.
- Опыт построения платформы для on-premise, cloud или гибридной инфраструктуры.
- Практический опыт реагирования на инциденты, организации дежурств и проведения postmortem.
Будет преимуществом :
- Опыт эксплуатации банковских, платёжных или других регулируемых систем, работы с высоконагруженными Java-сервисами и диагностики JVM, эксплуатации Kafka, PostgreSQL, Redis и других компонентов распределённых систем.
- Практика формализации SLI/SLO, error budgets и capacity planning.
- Опыт нагрузочного тестирования и анализа производительности всей цепочки от приложения до инфраструктуры.
- Опыт построения платформы для on-premise, cloud или гибридной инфраструктуры.
- Практический опыт реагирования на инциденты, организации дежурств и проведения postmortem.
Мы предлагаем:
- Официальное трудоустройство.
- Уровень вознаграждения обсуждается с успешным кандидатом