яндекс

Аналитик качества продуктовых агентских сценариев

Наша команда развивает Alice AI LLM — технологию, которая лежит в основе разных продуктов Яндекса. Главный из этих продуктов — чат с Алисой.

яндекс · На сервисе с: 13.07.26 12:21

↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМосква

Наша команда развивает Alice AI LLM — технологию, которая лежит в основе разных продуктов Яндекса. Главный из этих продуктов — чат с Алисой.

Мы фокусируемся на продуктовых агентских сценариях: задачах, где пользователь с помощью Алисы взаимодействует с экосистемой Яндекса. Наша цель — научить базовую модель идеально ориентироваться в этих сценариях, выступая умным и надёжным помощником-агентом (например, чтобы Алиса могла сама заказать продукты в Лавке, выбрать лучший смартфон на Маркете или спланировать сложный отпуск в Путешествиях).

Почему у нас классно:
* Мы учимся решать задачи, которые пока никто не умеет решать. Оценка агентских способностей в реальных продуктах сейчас активно развивается во всём мире, и здесь много пространства для собственных идей
* Alice AI — быстро растущий проект, у нас можно проявить себя и поработать с опытными ML-специалистами
* Можно гонять самые современные модельки Яндекса на мощных GPU-кластерах
* Данные, которые вы собираете, и бенчмарки, которые вы строите, напрямую обеспечивают процесс обучения (в том числе RL) базовой модели
* Наша работа напрямую влияет на то, как миллионы людей будут взаимодействовать с сервисами Яндекса в ближайшем будущем

Создание продуктовых бенчмарков

Наша главная задача — придумать критерии и построить надёжные бенчмарки, на которых можно честно сравнивать разные модели между собой в реальных продуктовых сценариях. Вам предстоит формулировать метрики оценки для задач, где модель взаимодействует с сервисами Яндекса (и не только!), и делать эти метрики стабильными.

Разработка сред для агентов

Вам предстоит много кодить на Python: оборачивать API сервисов (Маркета, Яндекс Еды и других) в виртуальные среды, в которых будут тестироваться, работать и обучаться наши агенты.

Сбор данных и генерация эталонных траекторий для RL

Современные модели учатся через взаимодействие со средой. Вам предстоит формулировать сложные задания и собирать эталонные траектории действий (golden trajectories). Вы будете управлять пайплайнами сбора данных, комбинируя разные подходы: работу с внутренними редакторами, краудсорс и автоматическую разметку через LLM-as-a-judge.

Анализ точек роста и погружение в данные

Всё ещё остаются сложные продуктовые сценарии, с которыми модель пока не справляется. Вы будете находить эти узкие места, разбирать проблемы и адаптировать под них бенчмарки. Для этой задачи крайне важна ваша личная насмотренность в текстах и логах моделей: способность «руками» прочувствовать данные и понять, как максимизировать рост качества.

Больше об аналитике в Яндексе — в канале Yandex for Analytics

* Отлично знаете Python: умеете писать сложный, чистый код (это необходимо для создания виртуальных сред)
* Уверенно владеете SQL, любите и умеете анализировать сложные структуры данных с его помощью
* Знаете теорию вероятностей и математическую статистику
* Понимаете, как устроены агентские системы, или участвовали в их построении
* Интересуетесь развитием LLM и хотели бы глубоко погрузиться в эту тему
* Очень самостоятельны и готовы браться за SOTA-задачи, для которых нет готовых решений

* Взаимодействовали в кросс-сервисных командах
* Понимаете, как работает RL (Reinforcement Learning) в контексте языковых моделей
* Работали с метриками в NLP или строили синтетические пайплайны генерации данных
* Свободно читаете на английском

Похожие вакансии Аналитика данных

Соц.сети
Н

Product Analyst

Неизвестный работодательНа сервисе с: 24.09.26 19:54
Зарплата не указанаНе указана странаЛокация не указанаУдалёнка

Product Analyst

Местоположение: Весь мир
Формат работы: Удаленно
Опубликована: ••••••••

Требования:
• Опыт самостоятельной продуктовой аналитики: от бизнес-вопроса до вывода и рекомендации
• Уверенные SQL и Python для анализа, расчётов и проверки данных
• Прикладная статистика и полный цикл A/B-тестов: мощность, выборка, доверительные интервалы
• Событийная и транзакционная аналитика: пользователи, дубли, пропуски, временные окна

Контакт: ••••••••

•••••••• опубликована в ••••••••

hh.ru
diasoft

Аналитик данных

diasoftНа сервисе с: 24.09.26 18:36
Зарплата не указанаРоссияМоскваГибрид

Основные задачи:

  • Анализировать источники данных: ERP-системы, API, базы данных, файлы, event-шины и Kafka;

  • Выявлять и формализовывать требования внутренних и внешних заказчиков к данным и аналитике;

  • Участвовать в проектировании аналитических витрин и моделей данных;

  • Описывать состав показателей, правила расчёта, связи между сущностями и требования к качеству данных;

  • Готовить SQL-прототипы, выборки и технические задания для команд Data Engineering;

  • Выполнять профилирование данных и анализ расхождений между источниками;

  • Участвовать в проверке полноты, актуальности, непротиворечивости и корректности данных;

  • Принимать участие в тестировании и валидации витрин, пайплайнов и интеграций;

  • Анализировать результаты обработки данных в Spark, Starrocks, Trino или аналогичных SQL-движках;

  • Поддерживать документацию по источникам, моделям, витринам и правилам трансформации;

  • Взаимодействовать с заказчиками, аналитиками, разработчиками, инженерами данных и архитекторами.

Обязательные требования:

  • Опыт работы дата-аналитиком, DWH-аналитиком, системным аналитиком или аналитиком витрин данных;

  • Уверенное знание SQL;

  • Опыт анализа данных из нескольких источников;

  • Понимание принципов построения DWH, Data Lake или Lakehouse;

  • Опыт работы с Apache Iceberg, Parquet и объектными S3-хранилищами;

  • Опыт работы с Apache Spark, Spark SQL или PySpark;

  • Знание Python для анализа и автоматизации;

  • Понимание слоёв данных, витрин, агрегатов и ETL/ELT-процессов;

  • Опыт подготовки требований, спецификаций или технических заданий;

  • Умение описывать правила расчёта показателей и преобразования данных;

  • Опыт профилирования и проверки качества данных;

  • Понимание принципов работы пакетных и потоковых загрузок;

  • Умение взаимодействовать с бизнес-заказчиками и техническими командами.

Будет преимуществом:

  • Опыт работы в банках, страховых, инвестиционных или других финансовых компаниях;

  • Опыт работы с Impala, Trino, Hive, Greenplum или аналогичными движками;

  • Опыт работы с API, event-шинами и потоковыми данными;

  • Опыт работы с Kubernetes на уровне понимания среды исполнения;

  • Знание инструментов визуализации данных;

  • Опыт работы с Data Quality, Data Governance или Data Catalog.


МЫ ПРЕДЛАГАЕМ:

  • Полную занятость, график работы 5/2. Гибкое начало рабочего дня.
  • Гибридный формат работы (не менее 1-го дня в неделю из офиса, 4 дня дистанционно) для городов: Москва, Санкт-Петербург, Ярославль, Чебоксары, Воронеж, Самара, Пермь, Уфа.
  • Оформление по ТК РФ, бессрочный трудовой договор.
Соц.сети
wooppay

Product Analyst

wooppayНа сервисе с: 24.09.26 17:55
Зарплата не указанаКазахстанКарагандаГибрид

Product Analyst Wooppay

Местоположение: Караганда
Формат работы: Гибрид
Опубликована: ••••••••

Требования:
• Опыт с SQL и продуктовой аналитикой
• Python (pandas/numpy)
• Понимание unit-экономики и финтех-метрик

Контакт: ••••••••

•••••••• опубликована в ••••••••

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.