Н

Data инженер

Неизвестный работодатель · На сервисе с: 19.08.26 11:34

Зарплата не указанаРоссияУдалёнка

🧠😘😀😘😘🥰😀🫢
Data инженер
Грейд: Senior
Локация специалиста: РФ
Загрузка специалиста Full-time
• Гражданство: РФ
• Формат работы: удалённо

Описание проекта:
Разработка и развитие систем больших данных с использованием Python, Spark, Hadoop и современных инструментов обработки и хранения данных. Проект включает разработку низкоуровневой архитектуры, программного кода, ETL-процессов, оптимизацию и выпуск решений в промышленную эксплуатацию.

Задачи на проекте:
● Разработка низкоуровневой архитектуры систем больших данных на основании требований аналитиков и архитекторов.
● Подготовка документации по низкоуровневой архитектуре.
● Разработка программного кода систем больших данных.
● Разработка программ распределённых вычислений на Spark.
● Разработка и сопровождение ETL-процессов.
● Подготовка документации по алгоритмам разработанных систем.
● Разработка Unit-тестов.
● Подготовка и сборка установочных пакетов для промышленной среды.
● Проведение плановых работ по оптимизации программного кода.
● Исправление дефектов в разработанных приложениях.
● Подготовка и выпуск пакетов обновлений, включающих исправления и оптимизацию кода.
● Проведение Code Review.

Требования:
● От 3 лет коммерческой разработки.
● От 2 лет разработки систем, вышедших в промышленную эксплуатацию.
● От 2 лет опыта работы с Big Data.
● Глубокие теоретические знания и практический опыт работы со стеком технологий.
● Опыт работы с бизнес-требованиями: сбор, формирование и анализ.
● Опыт работы в условиях постоянно меняющихся требований.
● Умение давать и принимать обратную связь.
● Опыт написания программ распределённых вычислений на Spark.
● Опыт разработки ETL-процессов.
● Опыт проведения Code Review.
● Опыт или понимание разработки и проектирования архитектуры БД.
● Опыт создания и работы с БД.
● Опыт оптимизации SQL-запросов.
● Понимание процессов CI/CD.
● Опыт написания Unit-тестов.
● Python 3.5+.
● Spark 2.2+.
● Hadoop, Hive.
● Airflow.
● Kubernetes (K8S).
● SQLAlchemy.
● PostgreSQL, Greenplum.
● PyTest / Unittest.
● Flake8 / PyLint, Black.
● Docker.
● Git, GitLab, CI/CD.
● Умение разрешать конфликты в Git.
● Shell, Linux.

Похожие вакансии Data Engineer

Сайты компаний
vk

Старший дата-инженер / DWH-инженер

vkНа сервисе с: 19.07.26 17:09↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМоскваОфис

Развиваем DWH Дзена на YTsaurus: от слоёв хранилища и data quality до сервисов, которыми ежедневно пользуются аналитики и продуктовые команды.

Что делаем:

  • Хранилище: многослойная модель raw → ods → dds → cdm → stg → export со строгими соглашениями именования и data quality поверх ~120 пайплайнов с алертингом
  • Дата-продукты: каталог таблиц и трекинг SLA доезда данных (lineage/governance), кастомный планировщик workflow, бот-интерфейс к сервисам DWH 
  • Работаем в монорепозитории (>1200 модулей-трансформаций) с автоматизированным code review через CI и дежурствами

Ищем инженера широкого профиля: данные + сервисы. 

Задачи

  • Развивать внутренние продукты команды: проектировать и писать сервисы, API, интеграции
  • Проектировать и развивать модели данных по слоям хранилища
  • Писать и оптимизировать трансформации на YQL и Python
  • Поддерживать и расширять оркестрацию пайплайнов
  • Развивать мониторинг качества данных и реагировать на инциденты
  • Участвовать в ревью и поддерживать инженерную планку команды

Требования

  • Уверенный Python: production-код, сервисы, а не только скрипты
  • Крепкий SQL и понимание аналитических запросов и их оптимизации
  • Опыт проектирования и поддержки бэкенд-сервисов / API / интеграций
  • Понимание, как устроен слоёный DWH (модели данных, инкрементальная загрузка, партиционирование)
  • Аккуратность к качеству данных и к соглашениям (именование, технические поля)

Эта вакансия также есть на:hh.ru
Сайты компаний
vk

Руководитель группы

vkНа сервисе с: 17.06.26 20:36↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМосква

VK Реклама — платформа, которая объединяет все крупнейшие в России и СНГ социальные сети и сервисы с общим охватом более 140 млн человек. Благодаря VK Рекламе у рекламодателей есть единая точка доступа к аудитории рунета и колоссальному объёму мобильного трафика высокого качества.

Ядро рекламной системы — аукцион, обеспечивающий эффективную реализацию выбранных рекламодателями стратегий ставок и подбор рекламы для пользователей. Мы ищем руководителя в команду вертикалей рекламы, которому интересно глубоко погрузиться в механику аукциона, растить эффективность рекламных продуктов и стратегий ставок с помощью методов машинного обучения.

Что предлагаем:

  • Возможность внедрять решения, влияющие на ~100 млн пользователей ежедневно
  • Интересную предметную область — реклама сочетает в себе рекомендательную систему и аукцион со множеством дополнительных механизмов
  • Технологические платформы компании, упрощающие внедрения в рантайм

Задачи

  • Руководить командой: наём, развитие, performance review
  • Декомпозировать бизнес-цели и проекты до уровня задач для команды
  • Повышать эффективность рекламы при помощи ML-алгоритмов
  • Предлагать новые решения и проводить A/B-эксперименты для оценки гипотез
  • Обеспечивать стабильность ML-решений в высоконагруженном рантайме

Требования

  • Опыт руководства командой ML или разработки от двух лет
  • Опыт развития команды, проведения code review
  • Практический опыт разработки на Java, Python или C++
  • Знание классических методов машинного обучения (линейные модели, градиентный бустинг, матричные факторизации, методы NLP) и DL
  • Понимание принципов и методов предобработки данных, feature engineering и оценки моделей
  • Знание алгоритмов и структур данных

Будет плюсом

  • Опыт разработки рекомендательных систем
  • Опыт работы с большими данными (Spark, Hadoop, YTsaurus)
Сайты компаний
сбер

Data Engineer/Data Analyst

сберНа сервисе с: 16.06.26 18:35↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМоскваОфис

Ищем в команду аналитика данных, для улучшения операционного качества работы сотрудников наших офисов.

  • сбор, обработка, анализ исходных данных

  • подготовка презентационных материалов

  • разработка алгоритмов в Greenplum

  • контроль качества данных

  • взаимодействий с бизнес подразделением (проведение очных встреч, теле и видео коммуникаций).

  • высшее образование

  • уверенное знание SQL, (опыт написания сложных запросов, хранимых процедур)

  • высокий уровень знания Excel (PowerPivot, PowerBi)

  • опыт рефакторинга кода, оптимизации

  • умение читать чужой код

  • будет плюсом: опыт работы в банковской сфере, опыт работы с Greenplum, Teradata, знание Python.

  • ежегодный пересмотр зарплаты, годовая премия

  • расширенный ДМС с первого дня и льготное страхование для близких

  • уникальная система обучения Сбера для профессионального и карьерного развития

  • бесплатная подписка СберПрайм+ и скидки на продукты компаний-партнеров

  • вознаграждение за рекомендацию друзей в команду Сбера

  • ипотека выгоднее до 4% для каждого сотрудника

  • корпоративная пенсионная программа

  • комфортабельный офис м. Новослободская

Эта вакансия также есть на:hh.ru

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.