яндекс

GPU Performance Engineer

яндекс · На сервисе с: 18.07.26 01:58

↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМосква

Мы управляем одним из самых дефицитных и самых дорогих ресурсов компании — графическими процессорами (GPU). Их эффективное использование ĸритичесĸи важно для работы ключевых сервисов Яндекса: Поиска, Рекламы, Алисы, Такси, Музыки и других продуктов на базе ИИ.
Наша миссия — обеспечить максимальную отдачу и эффект от каждой GPU-ĸарты. Это не просто администрирование ресурсов, а стратегическая роль на стыĸе технологий и бизнеса.

Мы ищем GPU Performance Engineer, который поможет растить эффективность утилизации GPU, выжимать максимум производительности из GPU-вычислений и делать наши системы быстрыми, масштабируемыми и устойчивыми под высокой нагрузкой.

Команда работает с 150+ продуктами, где GPU — основа для моделей ИИ. Вы станете связующим звеном между инженерными командами и топ-менеджментом, превращая технические решения в прямую финансовую выгоду.

Вы войдёте в команду, которая напрямую влияет на эффективность ключевых продуктов Яндекса. У нас нет бюрократии — решения принимаются быстро, а инициативы приветствуются. Сейчас особенно ценятся идеи, ĸаĸ повысить эффективность использования GPU.

Мы совмещаем техническую экспертизу с бизнес-ориентированностью. Например, недавно запустили систему перераспределения GPU между командами с учётом стратегии развития каждого отдельного сервиса и стратегии развития всей компании. Инициатива сэкономила компании сотни миллионов рублей и обеспечила буст для фокусных направлений.

В планах — создать единый стандарт использования GPU для всех сервисов Яндекса с прицелом на рост эффективности использования и максимизацию объёма получаемого профита.

Повышение эффективности утилизации GPU

Вы будете формировать гипотезы и исследовать способы повышения эффективности утилизации GPU, участвовать в реализации и внедрении наиболее профитных решений. Нужно будет формировать рекомендации и лучшие практики по повышению производительности, чтобы выжимать максимум из GPU-инфраструктуры.

Оптимизация и профилирование

В ваши обязанности войдёт поиск узких мест (bottlenecks) в производительности и их устранение с помощью профилировщиков, а также оптимизация доступа к памяти (memory access), ядер (kernels), времени ожидания (latency) и пропускной способности (throughput).

Развитие инструментов диагностики

Вы будете создавать и улучшать инструменты для быстрого выявления и устранения инфраструктурных проблем, которые влияют на эффективность утилизации, стабильность и сĸорость GPU-вычислений (ĸаĸ для обучения, так и для инференса).

Исследование и внедрение современных решений

Вам предстоит изучать новейшие подходы ĸ организации инфраструктуры для обучения и инференса, оценивать их эффективность и внедрять в реальные проекты.

Анализ архитектуры, тестирование, интеграция

Вы будете тесно взаимодействовать с разработчиками, ML-инженерами и системными архитекторами. Предстоит участвовать в оценке аппаратных решений и предлагать улучшения для будущих поколений GPU, а также разрабатывать планы тестирования, формировать бенчмарĸи, проводить анализ регрессий производительности.

Больше об ML в Яндексе — в канале Yandex for ML

* Знаете Python и занимались системным программированием, разрабатывали библиотеки или фреймворĸи
* Работали с фреймворĸом PyTorch и распределённым обучением через torch.distributed
* Применяете подходы параллелизации, включая data parallelism, tensor parallelism, pipeline parallelism, expert parallelism, для распределённого инференса или обучения
* Интересуетесь LLM и MLOps: понимаете задачи и вызовы, которые связаны с эксплуатацией больших моделей в продакшене
* Работали с GPU (NVIDIA) и CUDA: понимаете архитектуру GPU, разрабатывали или оптимизировали алгоритмы под CUDA, использовали Nsight, nvprof или их аналоги
* Умеете оптимизировать производительность GPU-приложений и повышать эффективность утилизации GPU
* Способны анализировать профили и метрики производительности
* Можете читать и оптимизировать сложный ĸод
* Умеете эффективно работать в команде и готовы делиться знаниями

* Уверенно владеете C/C++ или аналогичными низкоуровневыми языками
* Работали с библиотеками RL-обучения для LLM: veRL, slime, NeMo-RL, SkyRL и другими
* Работали с библиотеками инференса: vLLM, SGLang и TRTLLM
* Имеете опыт оптимизации под реальные продаĸшен-нагрузĸи, работали с low-latency- или real-time-системами

Похожие вакансии C++/C

hh.ru
гаскар групп

Разработчик алгоритмов наведения (ROS2/C++)

гаскар группНа сервисе с: 24.06.26 17:14↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМоскваОфис

Гаскар Групп – это российский разработчик и интегратор собственных ИТ решений, разработчик и производитель беспилотных летательных аппаратов для обеспечения их автономности. Продукция применяется для мониторинга территорий, доставки легковесных грузов и других миссий.

Производство полного цикла, от создания идеи и разработки до выпуска готовой продукции в серии!

Мы производим: БВС, оптику, литий-ионные аккумуляторы, электродвигатели, модемы, контролеры связи, пульт управления, СКС и программируем своей собственный СОФТ для наших продуктов.

Мы предлагаем погрузиться в мир инноваций и технологических разработок.

Мы разрабатываем программно-аппаратные комплексы для беспилотных авиационных систем, включая средства обнаружения, сопровождения и перехвата воздушных целей.

Ищем разработчика алгоритмов наведения, который будет заниматься развитием бортовой логики управления перехватчиком, разработкой алгоритмов наведения по данным различных сенсоров и интеграцией решений в реальную летную платформу.

Работа предполагает участие не только в разработке программного обеспечения, но и в испытаниях изделий, анализе результатов полетов и доводке алгоритмов до практического применения.

Чем предстоит заниматься :

  • Разрабатывать и сопровождать алгоритмы наведения БПЛА;
  • Разрабатывать алгоритмы сопровождения и перехвата целей;
  • Работать с математическими моделями движения цели и носителя;
  • Разрабатывать и совершенствовать алгоритмы управления в реальном времени;
  • Проводить моделирование и испытания в симуляторах;
  • Интегрировать алгоритмы в бортовое программное обеспечение;
  • Анализировать телеметрию, логи и результаты летных испытаний;
  • Участвовать в наземных и летных испытаниях изделий.


Требования к кандидату:

  • Уверенное владение C++ и знание Linux;
  • Опыт многопоточной разработки и создания систем реального времени;
  • Опыт работы с одноплатными компьютерами: range Pi, Raspberry Pi, NVIDIA Jetson;
  • Понимание архитектуры ROS2, DDS и принципов меж процессного взаимодействия;
  • Знание методов наведения: Proportional Navigation (PN), Pure Pursuit, Lead Pursuit и другие современные методы наведения;
  • Знание MAVLink и принципов управления БПЛА;
  • Понимание теории управления;
  • Уверенное понимание кватернионов, матриц поворота и углов Эйлера.


Будет плюсом:

  • Опыт работы с Jira или аналогичными системами управления задачами;
  • Умение работать с системами контроля версий: git;
  • Опыт разработки под ROS2 Понимание принципов работы РЛС и обработки координатной информации;
  • Опыт математического моделирования динамических систем;
  • Навыки анализа телеметрии и логов.


Наши условия для тебя:

  • Официальное трудоустройство, полностью "белая" заработная плата;
  • Соц. пакет по ТК РФ;
  • Заработная плата обсуждается с финальным кандидатом;
  • Офис расположен в шаговой доступности от станции м. Войковская, бизнес-центр уровня А-класса;
  • Уютный современный офис, оснащенный по последнему слову техники;
  • График работы с 09:00 до 18:00. Пятница сокращенный день;
  • Дружный коллектив и хороший психологический климат;
  • Открытая, демократичная культура. Возможность реализовать свои идеи.

    Просьба в сопроводительном письме указывать свои зарплатные ожидания!
hh.ru
лацит - лаборатория цифровых технологий

Инженер по системам восприятия

лацит - лаборатория цифровых технологийНа сервисе с: 20.08.26 10:16
Зарплата не указанаБеларусьМинскГибрид
Обязанности:
  • Разработка и оптимизация пайплайна детектирования препятствий на основе данных с RGB/Stereo камер и лидаров.
  • Sensor Fusion: объединение данных с RGB/Stereo камер, лидаров.
  • Калибровка сенсоров: выполнение intrinsic и extrinsic калибровок камер и лидаров, включая разработку автоматизированных стендов для калибровки на производстве.
  • Разработка алгоритмов удаления шумов и артефактов из данных: фильтрация выбросов облаков точек (статистическая, радиусная), восстановление карт глубины (depth completion/inpainting).
  • Классификация и сегментация объектов: выделение динамических и статических препятствий, построение семантической карты на основе ML-моделей.
  • Внедрение ML-моделей в пайплайн C++.
  • Поиск bottleneck и оптимизация производительности всего CV/ML пайплайна.
Требования:
  • Отличное знание Python, C++ 17/20.
  • Опыт работы с OpenCV, PCL, PyTorch.
  • Глубокое понимание Sensor Fusion
  • Опыт калибровки камер и лидаров, включая автоматизацию процесса калибровки.
  • Опыт обучения и тонкой настройки нейросетей в области задач детекции и сегментации.
  • Опыт подготовки датасетов.
  • Умение разбираться в чужом коде.
  • Владение английским языком на уровне B1.

Плюсом будет:

  • Глубокое понимание ISP.
  • Опыт работы с TensorRT, CUDA.
  • Опыт работы с Nvidia Jetson.
  • Опыт использования современных практик и инструментов (CI/CD, docker, git, jira, etc.).

Условия:

  • Официальное трудоустройство,
  • Возможность профессионального роста в дружной компании,
  • Комфортные офисы,
  • Сложные и высокотехнологичные проекты,
  • Серьезные, толковые техлиды и менеджеры,
  • Гибкую и демократичную систему управления.
Ссылка на вакансию в банке вакансий на gsz.gov.⁣by: вакансия открыта на перспективу
Сайты компаний
лаборатория касперского

Developer C++ (CoreTech, Antimalware PDK)

лаборатория касперскогоНа сервисе с: 17.07.26 13:31↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМосква

CoreTech — это R&D внутри департамента исследований и разработки Лаборатории Касперского. Мы создаем фундамент, на котором строится разработка продуктов и сервисов нашей компании. В нашем отделе есть несколько основных направлений деятельности в которые сейчас открыты вакансии:
Antimalware PDK – команда, развивающая технологии защиты в составе отдела разработки базовых компонентов (Core Tech). Команда разрабатывает ключевые компоненты обнаружения угроз, аномалий, уязвимых приложений и сервисов ОС, нейтрализации выявленных угроз. Разрабатываемый функционал является неотъемлемой частью большинства продуктов компании, используемых на различных ОС.


Основные сценарии:

  • Real-time protection - мониторинг активности системных и пользовательских служб и приложений (открытие файлов, запуск процессов и т.п.), предотвращение активации угроз в режиме реального времени;
  • On-demand scans - сканирование заданных областей на защищаемом устройстве (файлов, директорий, объектов автозапуска, памяти и т.п.);
  • Обработка обнаруженных угроз - удаление, лечение, лечение активного заражения, бэкап и восстановление пользовательских данных;
  • XDR-сценарии - сбор телеметрии, запуск задач-респонзов на хостах (например: помещение объекта в карантин, блокировка пользователя, yara/ioc/oval проверки);
  • Оптимизация сценариев сканирования - поддержка исключений, оптимизация потребляемых ресурсов.

Чем Вы будете заниматься:

  • Разрабатывать и поддерживать функциональность компонентов защиты, писать функциональные и юнит-тесты;
  • Участвовать в выработке технических решений;
  • Выполнять анализ производительности в поддерживаемых командой сценариях, оптимизировать код;
  • Развивать техническую экспертизу в составе команды и за ее пределами.

Что мы ждем от кандидата:

  • Отличное знание C++ и современных стандартов (11/14/17);
  • Опыт разработки многопоточных приложений;
  • Знание системного API (Windows, POSIX);
  • Умение работать с отладчиками и анализировать дампы (WinDBG, gdb, т.д.);
  • Навык проведения код-ревью;
  • Опыт работы с системами сборки (CMake и т.п.);
  • Опыт работы с системами контроля версий (Git, Perforce);
  • Опыт разработки тестов с помощью фреймворка GMock/GTest;
  • Быть готовым к погружению в большую кодовую базу, к анализу логов для поиска причины проблемы;
  • Желание писать структурированный, понятный код, покрывать его тестами и понимание зачем это нужно.

Эта вакансия также есть на:hh.ru

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.