
Наша группа — часть Platform Engineering в Яндексе. У Яндекса большой серверный парк, распределённый по нескольким локациям, в которых живут несколько отдельных облаков. В каждом облаке мы строим сервис, позволяющий автоматически управлять…
яндекс · На сервисе с: 16.09.26 07:00
Наша группа — часть Platform Engineering в Яндексе. У Яндекса большой серверный парк, распределённый по нескольким локациям, в которых живут несколько отдельных облаков. В каждом облаке мы строим сервис, позволяющий автоматически управлять серверами и доводить их утилизацию до максимума.
Мы разрабатываем систему, которая предоставляет нашим пользователям железо как сервис (Hardware-as-a-Service — HaaS). Цели системы:
* Автоматизировать процессы управления серверами
* Автоматизировать диагностику и устранение проблем на серверах
* Обеспечивать работоспособность серверной инфраструктуры
* Создавать инструментарий, чтобы координировать плановые работы на серверах
* Управлять доступами и правами на серверах
Наша система управляет примерно 98% мощностей компании: сотнями тысяч серверов в нескольких географически распределённых дата-центрах. На этих серверах запущены миллионы контейнеров с приложениями Яндекса.
Наш стек:
* Код — Go и Python 3
* Инфраструктура — YDB, MongoDB, Kubernetes, Terraform
Подписывайтесь на телеграм-канал Yandex Infrastructure, чтобы узнать больше о том, как мы делаем внутреннюю инфраструктуру Яндекса.
Общее ускорение работы системы
Наша система собирает сотни метрик с каждого сервера. Вы будете вместе с нами оптимизировать и ускорять все пайплайны доставки и обработки данных.
Построение системы управления правами и доступами для виртуальных машин
Мы строим новый сервис, который объединит в себе инвентаризацию и управление доступами к виртуальным машинам. Наша цель — эффективно и быстро (за секунды) выдавать тысячам инженеров доступы к сотням тысяч виртуальных машин.
Создание эффективного планировщика регламентных/массовых работ
Каждый день в дата-центрах проводят десятки регламентных работ: меняют свитчи, апгрейдят стойки, планово выводят отдельные серверы в обслуживание. Наша задача — проводить все операции максимально эффективно и с минимальным влиянием на доступность облаков.
Больше о бэкенде в Яндексе — в канале Yandex for Backend
* Занимались промышленной разработкой на Go или Python от трёх лет
* Проектировали и разрабатывали распределённые и высоконагруженные сервисы
* Глубоко знаете Linux
* Занимались многопоточным и асинхронным программированием
* Имеете опыт сетевого программирования
* Получили коммерческий опыт в проектах с большим количеством интеграций
* Работали с реляционными (PostgreSQL) и NoSQL (MongoDB) базами данных, умеете составлять сложные запросы и оптимизировать их
HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.