• Управление GPU-кластером (CUDA MPS)
llp_qazcloud · На сервисе с: 07.06.26 13:54
MLOps-инженер LLP QazCloud
Местоположение: Астана
Формат работы: Гибрид
Опубликована: ••••••••
Требования:
• Деплой и обслуживание LLM (vLLM)
• Работа с Triton Inference Server
• Управление GPU-кластером (CUDA MPS)
• Строительство CI/CD для AI-сервисов
• Опыт с Kubernetes, Docker
• Мониторинг GPU метрик
• Работа с реляционными и векторными БД
•••••••• опубликована в LinkedIn у ••••••••
HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.