группа it-компаний lad

Linux-инженер (сопровождение on-premise AI-платформы)

Мы — группа IT-компаний Lad: 34 года помогаем бизнесу автоматизировать процессы и внедрять новые технологии, более 500 специалистов в команде. В 2025 году вошли в ТОП-100 работодателей России и заняли 1 место среди IT-компаний Нижегородско…

группа it-компаний lad · На сервисе с: 01.10.26 12:18

Зарплата не указанаРоссияНижний НовгородУдалёнка

Мы — группа IT-компаний Lad: 34 года помогаем бизнесу автоматизировать процессы и внедрять новые технологии, более 500 специалистов в команде. В 2025 году вошли в ТОП-100 работодателей России и заняли 1 место среди IT-компаний Нижегородской области.

Ladcraft — платформа автономных ИИ-агентов для бизнеса. Разворачивается на серверах заказчика в изолированной сети, без доступа в интернет, и работает в Kubernetes; часть инсталляций использует локальный инференс моделей на GPU. Ваша задача — обеспечивать стабильную работу этой инфраструктуры.

Чем предстоит заниматься:

  • Анализировать логи и метрики заказчиков: системные логи, логи сервисов, дашборды Grafana, метрики Prometheus.
  • Обновлять компоненты по инструкциям от команды разработки: пакеты, сервисы, бандлы.
  • Готовить хосты к установке: базовая настройка ОС (Альт Сервер 10.4 / Debian / Ubuntu / Astra SE 1.7, 1.8), проверка ресурсов, сети и файловых систем.
  • Настраивать и диагностировать GPU: доступность видеокарт, драйверы, распределение видеопамяти между LLM-моделями, контроль температур и загрузки.
  • Разбирать инциденты в Kubernetes: падающие поды, нехватка ресурсов, OOMKill, CrashLoopBackOff, проблемы с Ingress, ConfigMaps, Secrets, PVC.
  • Локализовать лёгкие и средние инциденты, применять типовые решения и эскалировать с полным контекстом: логи, метрики, шаги, гипотезы.
  • Взаимодействовать с DevOps и разработкой, готовить репродукции проблем.
  • Общаться с заказчиком в чатах и по почте: собирать данные по инциденту, согласовывать окна обновлений, отчитываться о результатах.
  • Развертывать платформу в закрытых контурах.
  • Первоначальная настройка контура.

Что мы ожидаем:

  • Linux на уровне уверенного пользователя: процессы и нагрузка, службы, файловые системы и сетевые соединения.
  • Уверенное владение Kubernetes: архитектура кластера, работа с kubectl, диагностика подов, понимание Ingress, Services, ConfigMaps, Secrets, PVC/StorageClass, ResourceQuota, HPA. Умение читать манифесты и понимать, что в них не так.
  • Понимание сетей: TCP/UDP, DNS, MTU, базовая диагностика.
  • Опыт работы с мониторингом: Prometheus, Grafana, Loki — чтение дашбордов, поиск аномалий.
  • Понимание HTTP-кодов ошибок (502, 504) и их причин в инфраструктуре с прокси и балансировщиком.
  • Базовый bash для простых скриптов диагностики.
  • Понимание принципов systemd: unit-файлы, зависимости, статусы служб.
  • Понимание работы локального инференса: видеопамять и требования моделей, диагностика нехватки видеопамяти, знакомство с утилитами мониторинга GPU.
  • Умение самостоятельно выстраивать план диагностики: ОС → Kubernetes → приложение → сеть.
  • Коммуникационные навыки: чётко формулировать вопросы, собирать нужные данные и объяснять статус и дальнейшие шаги инженерам и руководителям проектов заказчика.
  • Готовность вовремя признавать незнание и эскалировать, спокойствие в инцидентах: сначала факты, потом действия.

Мы предлагаем:

  • Официальное трудоустройство, полная занятость.
  • Удалённый формат работы, в Нижнем Новгороде возможен гибрид.
  • Гибкое начало рабочего дня (9:00–11:00 по МСК).
  • Команда разработки и DevOps рядом: помогают, но ожидают самостоятельности в своей зоне.
  • Обучение и развитие: Lad Универ, внешние тренинги и митапы, выстроенный онбординг, индивидуальный план развития.
  • ДМС, чекапы, компенсация спорта.
  • Оплачиваемый выходной в день рождения, магазин мерча.

Похожие вакансии DevOps

hh.ru
bell integrator

DevOps-инженер

bell integratorНа сервисе с: 01.10.26 13:25
Зарплата не указанаРоссияМоскваУдалёнка

Описание проекта:

Проект по импортозамещению в банковской сфере.

Что мы ожидаем от вас:

  • Опыт работы с любой из систем Continuous Integration (Jenkins, TeamCity, Bamboo & etc);
  • Опыт работы с любой из систем Continuous Delivery (ArgoCD, Flux & etc);
  • Опыт работы с системами хранения артефактов (JFrog Artifactory, Nexus, ProGet);
  • Опыт проектирования и самостоятельной реализации CI-пайплайнов;
  • Опыт работы с Docker или podman, сборка образов, buildah в k8s;
  • Опыт работы с Kubernetes;
  • Опыт работы с Liquibase;
  • Уверенное владение Git;
  • Уверенное владение скриптовым языком Bash, GNU coreutils и BusyBox;
  • Приветствуется навык работы с Ansible и Jinja2;
  • Приветствуется навык работы с gradle;
  • Умение тестировать и измерять результаты своей работы

Дополнительные (желательные) требования:

  • Опыт работы с Service Mesh в части настройки observability, sidecar, канареечных релизов;
  • Опыт разработки Pipeline для рендеринга документов из Asciidoc;
  • Опыт работы с API при разработке Pipeline;
  • Jira;
  • Confluence;
  • Bitbucket;
  • GoLive;
  • Sonarqube-CE.
  • Крайне желательно:
  • Опыт работы с инструментами ETL: Airflow; Spark; Hadoop; JupyterHub; Trino; OpenMetaData.
  • Опыт работы с системами и протоколами авторизации/аутентификации:
  • Keycloak; Kerberos; OAuth 2.0; OpenID Connect.


Должностные обязанности:

  • Выполнять обязанности выделенного DevOps-инженера в продукт-рум;
  • Настраивать средства CI/CD для команды разработчиков;
  • Совершенствование CI/CD процессов;
  • Настраивать средства централизованного сбора и анализа логов для сервисов компании;
  • Помощь в формировании культуры релиз-менеджмента;
  • Подготовка сценариев разворачивания приложений и их формальное описание с помощью Jenkins;
  • Управление конфигурацией серверов;
  • Совершенствование систем мониторинга и логирования;
  • Тестирование инфраструктуры web-приложений (и esb-сервисов для направления SIP) до их выхода в продакшн: прогнозирование нагрузки, определение проблемных мест и их оперативное устранение;
  • Совершенствование системы контейнерной оркестрации;
  • Решение проблем и инцидентов;
  • Ведение документации, написание инструкций и схем.

Условия:

  • Формат работы Удаленно РФ/РБ;
  • Возможность профессионального и карьерного роста в компании, возможность поучаствовать в разных проектах;
  • Опыт работы в распределенной команде профессионалов;
  • Уровень заработной платы обсуждается индивидуально.
hh.ru
СБЕР

DevOps- инженер

СБЕРНа сервисе с: 01.10.26 12:55
Зарплата не указанаРоссияМоскваОфис

Наша команда занимается задачами по организации процесса производства на проекте по созданию ERP-системы, разрабатываем нобор сервисов по управлению хозяйственной деятельность предприятия, который должен заместить SAP в нашем Банке, затем тиражировать Это решение на российском рынке.

В задачах команды организация и поддержка процессов CI\CD для внутренней разработки, развертывание создаваемого продукта в модели SaaS в «облаке» Банка.

Обязанности

  • Установка, конфигурирование и поддержка прикладного ПО на тестовых контурах
  • Настройка CI/CD пайплайнов (Jenkins, Groovy / Pipeline as Code), автоматизация сборки, установки
  • Документирование процессов в инфраструктуре внедрения.

Требования

  • Знания о продуктах по организации инфраструктуры: Docker, Kubernetes, Helm
  • Знания о продуктах для организации регулярных работ и внедрений:
  • Опыт разработки Python-скриптов.

Условия

  • комфортный офис г. Москва, м. Тульская, БЦ "Кнопа"
  • ежегодный пересмотр зарплаты, и годовая премия
  • корпоративный спортзал и зоны отдыха
  • более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
  • расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
  • гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
  • подписка Прайм с возможностью совместного использования на трёх близких
  • вознаграждение за рекомендацию друзей в команду Сбера.
Соц.сети
S

Senior DevOps Engineer

symfaНа сервисе с: 01.10.26 12:19
Зарплата не указанаНе указана странаЛокация не указанаУдалёнка

👩‍💻Вакансия Senior DevOps Engineer

🟢Удаленно🟢Полная занятость
🟢ЗП обсуждается на собеседовании
🟢В компанию Symfa

🟦Описание вакансии
Мы ищем старшего DevOps-инженера для участия в крупномасштабном инфраструктурном проекте ведущей американской страховой компании из списка Fortune 500, ориентированном на контейнеризацию критически важных корпоративных приложений в саморазмещаемой, высокодоступной среде Kubernetes.

🟦Задачи
– Поддерживайте, масштабируйте и повышайте безопасность локальных кластеров Kubernetes (на собственном сервере, а не в управляемом облаке) для обеспечения высокой доступности и аварийного восстановления.
– Разработка, внедрение и управление инфраструктурой как кодом (IaC) для локальных сред с использованием Ansible и других инструментов автоматизации.
– Создание, оптимизация и мониторинг конвейеров Azure DevOps для CI/CD контейнеризированных приложений и изменений инфраструктуры.
– Поддержка и расширение компонентов инфраструктуры на базе Azure, интегрированных с локальными рабочими нагрузками.
– Внедрение и поддержка стека средств мониторинга: Prometheus, Grafana, Kafka (для потоковой передачи логов/метрик) и мониторинг баз данных (PostgreSQL, MongoDB).
– Упаковка и развертывание приложений с использованием Helm, обеспечивающие стандартизированные и воспроизводимые релизы.
– Разработка и поддержка скриптов на Bash и Python для автоматизации, устранения неполадок и создания инструментов.
– Взаимодействовать с командами разработчиков, специалистов по безопасности и эксплуатации для обеспечения надежности, соответствия нормативным требованиям и производительности платформы.
– Документируйте архитектуру, процессы и руководства по эксплуатации для обмена знаниями.

🟦Требования
– Более 5 лет практического опыта работы в качестве DevOps-инженера в корпоративных средах.
– Подтвержденный опыт развертывания и управления Kubernetes в локальной среде (кроме AKS/EKS/GKE).
– Уверенное владение Ansible для управления конфигурациями и автоматизации.
– Обширный опыт работы с Azure DevOps для проектирования и сопровождения конвейеров CI/CD.
– Уверенный опыт работы с Helm для упаковки приложений в Kubernetes.
– Практический опыт работы с Prometheus, Grafana и Kafka для мониторинга и потоковой передачи событий.
– Опыт управления и мониторинга баз данных PostgreSQL и MongoDB в производственной среде.
– Уверенное владение языками программирования Bash и Python для автоматизации и разработки инструментов.
– Уровень владения английским языком: B2 или выше — умение четко общаться с международными командами и заинтересованными сторонами.
– Продемонстрированная способность к сотрудничеству в команде и с клиентом.

🌐 ••••••••

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.