сбер. it

Data Engineer в центр робототехники

сбер. it · На сервисе с: 19.08.26 10:23

Зарплата не указанаРоссияМоскваОфис

В Центре робототехники Сбера мы создаем роботов и системы ИИ, которым нужны большие и аккуратно подготовленные наборы данных. Data Conveyor Team отвечает за путь этих данных от сырых записей до формата, с которым могут работать ML-команды. Сейчас нам нужен Software Engineer, который будет превращать записи с роботов и внешние датасеты в понятный, проверяемый и воспроизводимый формат для обучения моделей.

Первый этап отбора на эту вакансию — общение с AI-рекрутером. После отклика ждите сообщение от него, диалог займёт примерно 10 минут. Задача AI-рекрутера — уточнить недостающие детали и ускорить рассмотрение вашей кандидатуры. AI-рекрутер только начинает свой путь, поэтому просим относиться с пониманием. Ваш опыт и участие помогут сделать его удобным и полезным для всех!

  • проектировать и реализовывать пайплайны, которые превращают данные из разных источников в формат, пригодный для обучения моделей

  • стабилизировать основной путь конвертации данных с роботов: единый поддерживаемый процесс, проверяемые результаты, повторяемые запуски и понятные отчеты об ошибках

  • поддерживать dataset schema, versioning, compatibility checks, validators и manifests

  • подключать новые источники данных: записи с роботов, внешние датасеты, симуляции, egocentric data, данные тестовых запусков и корректирующих демонстраций

  • обеспечивать reproducible dataset builds и связь source data -> converted episodes -> filtered dataset -> dataset release -> training run -> benchmark result

  • создавать validation suite: проверка файлов, video/parquet layout, timestamps, required fields, metadata, annotation status и known historical variants

  • готовить данные к передаче в обучение так, чтобы ML-команды понимали состав датасета, ограничения, версию и качество

  • делать надежные CLI/tools, тесты, runbooks и отладочные отчеты для исследователей и инженеров.

  • сильный Python и опыт разработки batch / data processing pipelines

  • опыт backend, data engineering или software engineering для внутренних платформ и ML/data workflows

  • опыт работы с большими файлами, metadata manifests, reproducible builds и validation logic

  • практический опыт с Linux, Docker, Git, CI/CD и командной строкой

  • понимание storage и data formats: S3/object storage, network storage, parquet, zarr, hdf5, webdataset, video files или аналогичные форматы

  • умение разбираться в нестандартных форматах данных и приводить их к строгому контракту

  • готовность писать поддерживаемый production-like код, а не одноразовые conversion scripts.

Будет плюсом:

  • опыт с LeRobot, RLDS, DROID / Bridge / RT-X-like datasets, ROS bags или robotics trajectories

  • опыт с Ray, Airflow, Prefect, Kubernetes, SLURM, LSF или другими orchestration / job systems

  • опыт с W&B, MLflow, Hydra configs, experiment tracking или dataset management systems

  • понимание computer vision, multimodal data, VLA, imitation learning или robot learning

  • навыки работы с генеративными AI-моделями

  • опыт создания AI-агентов и использования их в работе будет преимуществом

  • опыт использования GigaChat, Kandinsky и аналогов в продуктах, навыки создания и использования AI-агентов

  • инструментальное владение AI для анализа, генерации и автоматизации.

  • офисный формат работы, адрес офиса Автозаводская 23а к2

  • ежегодный пересмотр зарплаты, квартальная и годовая премия

  • корпоративный спортзал и зоны отдыха

  • более 400 образовательных программ СберУниверситета для профессионального и карьерного развития

  • программа адаптации и помощь руководителя на старте

  • расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа

  • гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ

  • подписка Прайм с возможностью совместного использования на трёх близких

  • вознаграждение за рекомендацию друзей в команду Сбера.

Эта вакансия также есть на:hh.ru

Похожие вакансии Data Engineer

hh.ru
itransition

Intern Data Engineer

itransitionНа сервисе с: 20.08.26 10:43
Зарплата не указанаКазахстанГрузияАстанаУдалёнка

Itransition invites you to join our free internship. To participate, you will need an active Microsoft Azure account. Applicants are required to pass an entrance test.Please submit your resume, and once we review your application, we will get back to you with further details.

Requirements:

  • Active Microsoft Azure account
  • Basic python programming skills
  • Knowledge in SQL (SQL Server, Oracle, MySQL, BigQuery, Snowflake)
  • Understanding of basics of version control systems (Git, Subversion)
  • Intermediate or above level of English
  • Willingness to study intensively

Internship outline:

  • Attending lectures and seminars
  • Performing software development tasks
  • Independent study of training materials
  • Team work
  • Implementing a project on fully-functional web application development

We offer:

  • 2-month internship with the possibility of further employment via a world leading software development company (according to Forrester, Deloitte and Zinnov Research)
  • Projects for such clients as PayPal, Wargaming, Xerox, Philips, adidas and Toyota
  • Competitive compensation that depends on your qualification and skills
  • Career development system with clear skill qualifications
  • Flexible working hours aligned to your schedule
  • Options to work remotely
  • Corporate medical insurance covering services of private and public medical centers
  • English courses online
  • Corporate parties and events for employees and their children
  • Internal conferences, workshops and meetups for learning and experience sharing
  • Gym membership compensation, corporate sport competitions (cybersport included)
  • 5 days of paid sick leave per year with no obligation to submit a sick-leave certificate
hh.ru
usetech
Зарплата не указанаРоссияМоскваГибрид

Юзтех – группа аккредитованных ИТ-компаний полного цикла разработки с многолетней экспертизой в передовых технологиях: DWH, BigData, AI/ML, Blockchain, BI, предиктивная аналитика, цифровые двойники производства и рисков.

ГК Юзтех является технологическим партнером таких компаний, как Mail.ru, 2Gis, НЛМК, Еврохим, ГоИнвест, Альфа-Банк, Сбер, ВТБ, МКБ, Самолет, Х5 retail Group, Газпромнефть, Леруа Мерлен, Ситилинк, Ланит, IBS. Также, ГК разрабатывает собственные ИТ-продукты (Юзбас, Октопус, Тил Эйчар) и флагманские проекты, которыми пользуется 70% населения страны.

Сфера:

Ищем опытного DWH-разработчика в команду развития корпоративного хранилища данных. Хранилище объединяет данные о сотрудниках и используется аналитиками и Data Scientists для аналитики и повышения эффективности бизнес-процессов.

Формат: РФ, Москва, гибрид (офис 1-2 раза в неделю).

Задачи:

  • Разработка и развитие корпоративного DWH.
  • Анализ текущей архитектуры хранилища и интеграционных потоков.
  • Разработка и оптимизация сложных SQL-запросов.
  • Построение и развитие стабильных ETL-процессов.
  • Подключение новых источников данных.
  • Оптимизация производительности и существующих процессов загрузки данных.
  • Работа с REST API и CDC-механизмами.
  • Поддержка действующих интеграций, разбор инцидентов и небольшие доработки.
  • Участие в проектах по развитию архитектуры хранилища.
  • Соотношение задач: около 70% разработки / 30% сопровождения.

Мы ожидаем:

  • Опыт разработки DWH от 5 лет; кандидаты с сильным опытом от 4 лет также могут рассматриваться.
  • Экспертный уровень SQL: сложные JOIN, аналитические функции, оптимизация запросов.
  • Опыт работы с PostgreSQL от 1 года.
  • Опыт с Oracle или Greenplum будет релевантен как дополнительный опыт с СУБД.
  • Опыт построения и сопровождения ETL-процессов.
  • Опыт работы с Apache NiFi или аналогами, например Informatica.
  • Понимание различных подходов и методологий построения DWH.
  • Понимание принципов CDC.
  • Опыт интеграций через REST API.
  • Понимание жизненного цикла разработки данных: Git, CI/CD.
    Будет плюсом:
  • Опыт проектирования архитектуры DWH.
  • Навыки системного анализа и понимание бизнес-процессов.
  • Опыт с PySpark, Hadoop, Hive/Impala.
  • Опыт с Apache Airflow.
  • Python для автоматизации и обработки данных.
  • Опыт работы с корпоративными хранилищами в финтехе, страховании, HR или других крупных компаниях.

Мы предлагаем:

  • Карьерную и профессиональную возможность в стабильной, аккредитованной ИТ-компании;
  • Расширенный полис ДМС со стоматологией, корпоративный психолог;
  • Необходимую технику для комфортной работы;
  • Обучение, сертификацию, клуб английского языка;
  • Доступ к Корпоративной библиотеке и к Корпоративному университету;
  • Внутрикорпоративные профильные коммьюнити;
  • Заботу о детях сотрудников: корпоративные скидки, подарки, детские дни;
  • Геймифицированную программу лояльности: поверь, ты будешь восторге от нашего корпоративного магазина;
  • Корпоративную жизнь: мы много работаем и классно отдыхаем.
Сайты компаний
vk

Старший дата-инженер / DWH-инженер

vkНа сервисе с: 19.07.26 17:09↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМоскваОфис

Развиваем DWH Дзена на YTsaurus: от слоёв хранилища и data quality до сервисов, которыми ежедневно пользуются аналитики и продуктовые команды.

Что делаем:

  • Хранилище: многослойная модель raw → ods → dds → cdm → stg → export со строгими соглашениями именования и data quality поверх ~120 пайплайнов с алертингом
  • Дата-продукты: каталог таблиц и трекинг SLA доезда данных (lineage/governance), кастомный планировщик workflow, бот-интерфейс к сервисам DWH 
  • Работаем в монорепозитории (>1200 модулей-трансформаций) с автоматизированным code review через CI и дежурствами

Ищем инженера широкого профиля: данные + сервисы. 

Задачи

  • Развивать внутренние продукты команды: проектировать и писать сервисы, API, интеграции
  • Проектировать и развивать модели данных по слоям хранилища
  • Писать и оптимизировать трансформации на YQL и Python
  • Поддерживать и расширять оркестрацию пайплайнов
  • Развивать мониторинг качества данных и реагировать на инциденты
  • Участвовать в ревью и поддерживать инженерную планку команды

Требования

  • Уверенный Python: production-код, сервисы, а не только скрипты
  • Крепкий SQL и понимание аналитических запросов и их оптимизации
  • Опыт проектирования и поддержки бэкенд-сервисов / API / интеграций
  • Понимание, как устроен слоёный DWH (модели данных, инкрементальная загрузка, партиционирование)
  • Аккуратность к качеству данных и к соглашениям (именование, технические поля)

Эта вакансия также есть на:hh.ru

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.