avito

Data Scientist в команду LLM

avito · На сервисе с: 18.08.26 15:26

269k–413k ₽РоссияГибрид

В работе мы ставим амбициозные цели и не останавливаемся на достигнутом. Поэтому для нас так важно, чтобы каждый участник большой команды "Авито" разделял культуру компании. Погрузиться в неё помогает Манифест, в котором собраны наши основные ориентиры — миссия, ценности, принципы работы.

О команде

Наша команда занимается обучением собственных базовых LLM и их внедрением в разнообразные бизнес-сценарии Авито. Цель команды — обеспечить все продукты оптимальными моделями как по качеству ответов, так и по стоимости применения (cost-efficiency).

Мы адаптируем лучшие open-source-решения под русский язык и доменную специфику Авито с помощью continual pretraining и подмены токенизатора.

Для постоянного улучшения моделей мы непрерывно исследуем новые методы, пайплайны, включая RL и синтетические данные, и датасеты. Чтобы оставаться на острие технологий, мы проводим регулярные LLM-семинары, где разбираем свежие статьи и тренды AI.

Наш технический фокус сегодня

  • Построение оптимального и масштабируемого пайплайна для претрейна и дообучения LLM.
  • Оптимизация инференса: работа с современными движками, квантованием, speculative decoding и другими методами ускорения.

Примеры будущих задач

  • Масштабирование базовой модели A-vibe: исследование новых архитектур и подходов к обучению.
  • Оптимизация скорости и стоимости инференса высоконагруженных моделей в продакшене.
  • Проектирование и помощь в разработке внутренних LLM-платформ и multi-agent-систем.
  • Построение надёжной инфраструктуры для оценки качества моделей (evaluation).

Мы ждём, что вы

  • Хорошо понимаете основы машинного и глубокого обучения, знаете устройство Transformer и базовые подходы к работе с NLP-моделями.
  • Имеете практический опыт обучения или дообучения нейросетевых моделей и работы с датасетами, метриками и валидацией.
  • Уверенно пишете на Python, умеете работать с PyTorch и знакомы с базовыми инженерными практиками: Git, тестирование, Code Review.
  • Умеете корректно ставить эксперимент, сравнивать подходы и объяснять, почему получился тот или иной результат.
  • Можете самостоятельно доводить до результата задачу с понятной постановкой, вовремя подсвечивать риски и обращаться за помощью, когда она нужна.
  • Интересуетесь LLM, читаете технические материалы и готовы быстро осваивать новые инструменты и подходы.

Будет здорово, если вы:

  • Работали с Hugging Face Transformers, PEFT/LoRA или другими инструментами дообучения LLM.
  • Имеете опыт с современными NLP-моделями либо участвовали в их внедрении в продакшен.
  • Знакомы с инструментами распределённого обучения или оптимизации инференса: DeepSpeed, vLLM, SGLang, TensorRT-LLM и аналогами.
  • Использовали MLOps-инструменты для трекинга экспериментов и версионирования данных: Weights & Biases, MLflow, DVC и другие.
  • Участвовали в исследовательских проектах, open-source-разработке или соревнованиях по машинному обучению.

Работа у нас — это

  • Возможность влиять на продукт: ваши решения будут улучшать опыт миллионов пользователей.
  • Сложные технологические задачи на большом масштабе.
  • Мощное железо: доступ к производительным GPU-кластерам для экспериментов.
  • Сильное комьюнити: команда экспертов, с которой можно обсуждать идеи и подходы.
  • Развитие: бюджет на обучение, курсы, конференции и профессиональную литературу.
  • Забота о здоровье: ДМС со стоматологией с первого дня, в офисе принимают терапевт и массажист.
  • Гибкость: возможность работать удалённо или из офисов в 4 городах России.

Похожие вакансии Data Science & ML

Сайты компаний
сбер. it

Senior Embodied AI Engineer (VLA, управление роботом)

сбер. itНа сервисе с: 20.08.26 10:37
Зарплата не указанаРоссияМоскваОфис

Мы — команда, которая занимается обучением LLM, VLM и CV моделей. Создаем нативные омнимодальные архитектуры, новые способы кодирования и совместного обучения в доменах изображений, аудио, видео и т.д.

Наши основные направления: обучение LLM и VLM с нуля, разработка новых архитектур, Computer Vision research, создание opensource инструментов, сбор и подготовка данных, деплой моделей для MVP. Работаем на кластере с GPU уровня H100.

Ищем сильного инженера в направление Embodied AI, который будет связывать омнимодальные наблюдения с VLA-моделями и превращать их выходы в осмысленное поведение реального робота.

  • разработка и проведение экспериментов в области интеграции омнимодальных наблюдений с VLA-моделями и управления роботом в рамках проектов Embodied AI, воспроизводящих целенаправленное поведение на основе сенсорных данных и команд;

  • сбор, синхронизация и подготовка данных с сенсоров для обучения и инференса моделей;

  • запуск и отладка VLA-моделей на реальном железе, замер и снижение задержек в контуре «наблюдение → модель → действие».

  • уверенный Python и хороший C++, опыт работы с реальным железом: манипуляторы, мобильные или гуманоидные роботы;

  • ROS / ROS2 и middleware: разработка нод, взаимодействие с контроллером робота, работа с форматами данных;

  • работа с сенсорикой: IMU, гироскопы, лидары, специализированные камеры — калибровка, временная синхронизация, реалтайм-ограничения;

  • Embodied AI и VLA: опыт с Vision-Language-Action моделями или смежными подходами (VLM, imitation learning, RL), уверенный PyTorch;

  • опыт самостоятельного ведения экспериментов: от постановки гипотезы до запуска на роботе и оценки результата.

  • комфортный современный офис - м. Кутузовская

  • ежегодный пересмотр зарплаты, годовой бонус

  • корпоративный спортзал и зоны отдыха

  • более 400 образовательных программ СберУниверситета для профессионального и карьерного развития

  • расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа

  • гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ

  • подписка Прайм с возможностью совместного использования на трёх близких

  • вознаграждение за рекомендацию друзей в команду Сбера

  • корпоративная пенсионная программа.

Эта вакансия также есть на:hh.ru
hh.ru
сбер. it

Senior Data Scientist (Time series)

сбер. itНа сервисе с: 20.08.26 10:27
Зарплата не указанаРоссияМоскваОфис

Мы занимаемся тонкой настройкой клиентских стратегий: строим индивидуальные модели эластичности (uplift) к ставке по вкладам, потребкредитам, программам лояльности и другим продуктовым направлениям, прогнозируем досрочное погашение кредитов физлиц (time series + tabular ML) и повышаем экономическую эффективность розничного бизнеса на основе данных.

Обязанности

  • работать с большими данными в экосистеме Hadoop (PySpark, SQL) — от выгрузки и разведки до построения витрин для моделей
  • разрабатывать индивидуальные модели эластичности и клиентского поведения в сегменте B2C — от прототипа до продвинутого пайплайна обучения и предсказаний
  • проверять бизнес-гипотезы и превращать их в измеримый эффект: дизайн и оценка A/B-тестов (мэтчинг, продвинутые методы causal inference, интерпретация результатов)
  • Выстраивать коммуникацию с заказчиками: согласовывать метрики, защищать подходы, показывать ценность данных на понятном языке
  • Обеспечивать надёжность и мониторинг внедрённых решений — чтобы модель работала стабильно и приносила пользу каждый день.

Требования

  • опыт работы Data Scientist от 3 лет
  • техническое образование (будет плюсом если выпускник - МГУ, МФТИ, ВШЭ и других ведущих вузов страны)
  • понимание теории вероятностей и статистики.
  • Уверенное владение широким спектром ML-алгоритмов — регрессия, классификация, кластеризация, а также uplift-моделирование (способность оценивать причинно-следственные эффекты, а не просто предсказывать)
  • владение Python и ML библиотеками (numpy, sklearn, pandas, matplotlib/seaborn/plotly, catboost/lightgbm/xgboost, etc.)
  • плюсом будет опыт работы с pytorch, pyspark

Условия

  • комфортный современный офис рядом с м. Кутузовская
  • возможность выбрать удобный график – офис/гибрид
  • ежегодный пересмотр зарплаты, квартальная и годовая премия (премия указывается в зависимости от должности и системы премирования)
  • корпоративный спортзал и зоны отдыха
  • более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
  • программа адаптации и помощь руководителя на старте (для вакансий уровня Junior)
  • расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
  • гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
  • подписка Прайм с возможностью совместного использования на трёх близких
  • вознаграждение за рекомендацию друзей в команду Сбера.
hh.ru
гаскар групп

Инженер по компьютерному зрению

гаскар группНа сервисе с: 24.06.26 17:22↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМоскваГибрид

Гаскар Групп – это российский разработчик и интегратор собственных ИТ решений, разработчик и производитель беспилотных летательных аппаратов для обеспечения их автономности. Продукция применяется для мониторинга территорий, доставки легковесных грузов и других миссий.

Производство полного цикла, от создания идеи и разработки до выпуска готовой продукции в серии!

Мы производим: БВС, оптику, литий-ионные аккумуляторы, электродвигатели, модемы, контролеры связи, пульт управления, СКС и программируем своей собственный СОФТ для наших продуктов.

Мы предлагаем погрузиться в мир инноваций и технологических разработок.

Мы разрабатываем программно-аппаратные комплексы для беспилотных авиационных систем. В состав решений входят средства обнаружения, сопровождения и перехвата воздушных целей, а также собственное бортовое программное обеспечение.

Ищем инженера по компьютерному зрению, который будет на постоянной основе развивать направление машинного зрения: заниматься обучением и внедрением моделей, работать с датасетами, улучшать качество детекции и сопровождения целей, а также адаптировать решения под встраиваемые вычислительные платформы.

Нам нужен специалист, который будет полностью сфокусирован на данном направлении и сможет отвечать за весь жизненный цикл моделей — от данных до внедрения на изделие.

Чем предстоит заниматься :

  • Разрабатывать и дорабатывать алгоритмы обнаружения и сопровождения объектов.
  • Обучать, валидировать и тестировать модели компьютерного зрения;
  • Анализировать качество работы моделей и улучшать метрики;
  • Подготавливать и оптимизировать инференс для целевых вычислителей на базе Rockchip;
  • Интегрировать модели в существующую программную платформу;
  • Организовывать процессы разметки данных и контролировать качество датасетов;
  • Формировать требования к новым датасетам и участвовать в планировании сбора данных;
  • Проводить исследования и сравнительные испытания различных архитектур;
  • Готовить технические отчеты по результатам испытаний и качеству моделей;
  • Взаимодействовать с разработчиками бортового ПО, алгоритмистами и испытателями.

    Наши требования:
  • Уверенное владение Python и хорошее знание C++;
  • Практический опыт разработки решений в области Computer Vision;
  • Умение работать с системами контроля версий: git;
  • Опыт работы с Jira или аналогичными системами управления задачами;
  • Отличное понимание современных подходов к детекции объектов;
  • Глубокое знание семейства YOLO и опыт его применения в реальных проектах;
  • Понимание принципов работы камер и компьютерного зрения: (Дисторсия, калибровка камер, intrinsic и extrinsic параметры, системы координат, проективная геометрия);
  • Опыт подготовки и обучения собственных моделей;
  • Опыт оптимизации моделей для встраиваемых вычислителей;
  • Опыт работы с RKNN Toolkit и NCNN;
  • Понимание особенностей квантования, конвертации и ускорения нейронных сетей на платформах Rockchip;
  • Опыт работы с Linux.
  • Наши условия для тебя:

  • Официальное трудоустройство, полностью "белая" заработная плата;
  • Соц. пакет по ТК РФ;
  • Заработная плата обсуждается с финальным кандидатом;
  • Офис расположен в шаговой доступности от станции м. Войковская, бизнес-центр уровня А-класса;
  • Уютный современный офис, оснащенный по последнему слову техники;
  • График работы с 09:00 до 18:00. Пятница сокращенный день;
  • Дружный коллектив и хороший психологический климат;
  • Открытая, демократичная культура. Возможность реализовать свои идеи.

    Просьба в сопроводительном письме указывать свои зарплатные ожидания!

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.