uzum technologies. it

Senior Data Engineer (Streaming) (Python, Java)

Мы — команда разработки в составе крупного стрима Data Platform. Мы создаем и развиваем Customer Catalog — высоконагруженную платформу класса Feature Store. Наша главная текущая задача — построение собственной платформы для потоковой обраб…

uzum technologies. it · На сервисе с: 25.09.26 14:23

Зарплата не указанаРоссияМоскваУдалёнка

О нас и проекте

Мы — команда разработки в составе крупного стрима Data Platform. Мы создаем и развиваем Customer Catalog — высоконагруженную платформу класса Feature Store. Наша главная текущая задача — построение собственной платформы для потоковой обработки данных (Streaming).

Помимо стриминга, мы создаем внутренние DWH-инструменты на Golang и Scala, поэтому у нас много классической и интересной разработки. В нашей экосистеме мы активно используем кластер ScyllaDB, Spark и Airflow. Мы искренне ценим качество кода и используем все современные инженерные практики: автоматическое тестирование, выстроенный CI/CD, тщательный code review.

Сейчас в команде 3 сильных разработчика, и мы планируем расширение до 5 человек. Ищем зрелого инженера (ближе к Senior), который усилит нашу экспертизу.

Наш технологический стек:

  • Стриминг и инфраструктура: Flink, Kubernetes (k8s)

  • Работа с данными и оркестрация: ScyllaDB кластер, Apache Spark, Apache Airflow

  • Основной стек: Python, Java

  • Инструменты DWH / Дополнительный стек: Golang, Scala

Чем предстоит заниматься:

  • Проектировать архитектуру: участвовать в формировании архитектурного облика наших продуктов и платформы Feature Store.

  • Разрабатывать и внедрять: реализовывать сложные задачи по потоковой обработке данных, интеграции со ScyllaDB/Spark и DWH-инструментам.

  • Оценивать и планировать: декомпозировать задачи, участвовать в планировании спринтов и оценивать трудозатраты.

  • Отвечать за качество: писать юнит- и интеграционные тесты, проводить перекрестное code review.

  • Поддерживать решения: осуществлять саппорт разработанных инструментов при возникновении инцидентов (3-я линия).

Ближайшие цели и ключевые задачи сотрудника :

  • Проектирование и запуск NRT-пайплайнов: разработать и вывести в прод серию отказоустойчивых потоковых пайплайнов Near Real Time для обеспечения работы кредитного конвейера и систем антифрода.

  • Обеспечение данными ML и витрин: выстроить эффективную поставку потоковых данных (фичей) для real-time обучения и инференса ML-моделей.

  • Интеграция с клиентскими сервисами: настроить быструю отдачу агрегированных данных для мобильного приложения банка и смежных внутренних платформ.

  • Участие в развитии Feature Store: внести вклад в проектирование архитектуры нашей целевой стриминг-платформы на базе Apache Flink и ScyllaDB.

Мы ожидаем:

  • Опыт работы со Streaming-технологиями: уверенные знания и коммерческий опыт работы с Apache Flink.
  • Профессиональное владение стеком: глубокие знания Python и/или Java.
  • Опыт работы с Big Data экосистемой: опыт работы с Apache Spark, понимание принципов оркестрации процессов в Apache Airflow.
  • Инфраструктурный опыт: понимание принципов работы Kubernetes и построения CI/CD пайплайнов.
  • Инженерная зрелость: опыт проектирования архитектуры распределенных систем, любовь к тестам и качественному коду.

Будет плюсом:

  • Опыт работы с высоконагруженными NoSQL базами данных (желательно ScyllaDB или Apache Cassandra).

  • Интерес к backend-разработке и готовность/желание писать или кодить на Golang и Scala для задач DWH.

Мы предлагаем:

  • Амбициозные задачи и возможность влиять на ключевые бизнес-процессы;

  • Сильная техническая команда, которая всегда готова делиться опытом;

  • Крутая продуктовая культура. Опираемся на исследования и метрики, фокусируемся на результате;

  • Свобода действий и возможность напрямую влиять на развитие бизнеса;

  • Гибкий график. Гибридный или удаленный формат работы на выбор главное — результат;

  • Официальное оформление по ТК УЗ; Три дополнительных оплачиваемых дня к отпуску;

  • Мы резидент IT-парка, наши специалисты могут получить IT-визу, которая приравнивается к ВНЖ;

  • Развитие личного бренда на конференциях, митапах и внутренних событиях.

Похожие вакансии Data Engineer

hh.ru
сбер. it

Tech Lead Data engineer

сбер. itНа сервисе с: 25.09.26 13:56
Зарплата не указанаРоссияМоскваОфис

Мы передовое ИТ подразделение, создающее дата платформу на сотни петобайт данных для крупшейшего юнита банка

Нами реализована загрузка, обработка и контроль качества разрозненных данных из сотен систем-источников банка в единое хранилище в Data Lakehouse архитектуре на платформе Hadoop.

Ищем сильных и энергичных дата инженеров для развития нашей платформы в сторону обработки данных в режимах батчевой и потоковой загрузки.

Вы будете работать в сильной команде дата инженеров с сложными инженерными задачами, передовым стеком технологий и самыми большими объемами данных в Европе

Задачи разработки и поддержки витрин данных в Hadoop (HDFS, Icberg, Hive), ETL - Spark, CTL - Oozie, CI/CD - Jenkins + BitBucket.

языки - Python, Java, Scala.

Обязанности

  • разработка DWH/DataLake/LakeHouse
  • построение поставки данных в Batch
  • оптимизация ETL
  • разработка и валидация архитектуры данных
  • people management – планирование релизов, ресурсов команды
  • обеспечение надежности промышленных ETL потоков.

Требования

  • отличное знание SQL (join, CTE, оконные функции, фреймы и др.)
  • опыт работы с Hadoop, Spark, Iceberg
  • опыт работы с оркестраторами (например, Airflow) и CI/CD
  • опыт построения архитектуры данных (например, Data Vault, Инман, Кимбалл и др.)
  • опыт кратной оптимизации spark приложений
  • практический опыт разработки solution-архитектуры data-продуктов
  • практическое знание python на уровне разработки ETL будет преимуществом
  • практическое знание java/scala будет преимуществом
  • практический опыт создания и защиты архитектуры данных будет преимуществом
  • навыки работы с генеративными AI-моделями, опыт использования GigaChat, Kandinsky и аналогов в продуктах
  • навыки создания и использования AI-агентов инструментальное владение AI для анализа, генерации и автоматизации.

Условия

  • ежегодный пересмотр зарплаты и годовая премия
  • расширенный ДМС и льготное страхование для семьи
  • уникальная система обучения Сбера для профессионального и карьерного развития
  • выгодная ипотека для сотрудников
  • подписка Прайм с возможностью совместного использования на трёх близких
  • вознаграждение за рекомендацию друзей в команду Сбера
  • корпоративная пенсионная программа.
hh.ru
сбер. it

Data engineer

сбер. itНа сервисе с: 25.09.26 15:23
Зарплата не указанаРоссияМоскваОфис

Мы — команда, отвечающая за функционирование и бесперебойную поставку данных в аналитическую платформу данных розничного бизнеса на базе Greenplum и ClickHouse (промышленные витрины и лаборатория данных для аналитиков, объем данных – сотни Тб). Наша работа — это фундамент, на котором аналитики и data scientists строят свои модели и принимают ключевые бизнес-решения. Мы ищем коллегу, который поможет нам поддерживать и развивать платформу, автоматизировать процессы обработки данных и следить за качеством информации.

Обязанности

  • обеспечивать поставку данных: загружать данные на платформы Greenplum и Clickhouse с помощью наших внутренних инструментов. создавать собственные инструменты для поставки данных
  • управлять платформой: разрабатывать и внедрять сервисы для автоматизации управления платформой: вакуум, сбор статистики, удаление ненужных таблиц, оптимизация физ.дизайна, выявление токсичной активности и т.д
  • мониторить и оптимизировать: отслеживать состояние ETL-процессов в Airflow и собственных решениях) реагировать на сбои, находить и устранять "бутылочные горлышки" в дата-пайплайнах для ускорения загрузки
  • автоматизировать рутину: писать скрипты на Python для автоматизации повторяющихся задач по обработке данных
  • вести документацию: разрабатывать и поддерживать техническую документацию и базу знаний по нашим процессаму
  • участвовать в R&D: тестировать новые технологии и инструменты для улучшения нашей платформы данных.

Требования

  • опыт работы: не менее 2 лет в качестве Data Engineer / ETL Developer
  • python: написание дагов в Airflow, асинхронность (asyncio), взаимодействие через драйверы (psycopg2, clickhouse-driver), pandas, работа с API, веб-сервисы (FastAPI)
  • SQL: Уверенное владение: сложные запросы, оконные функции, CTE, умение читать планы выполнения, оптимизация запросов
  • СУБД: Знание архитектуры и опыт работы с МРР СУБД (Greenplum, Teradata, Exadata)
  • DWH/ETL: Знание современных принципов обработки данных Опыт разработки ETL-процессов, построения хранилищ и витрин данных
  • теоретическая база: Понимание принципов работы реляционных СУБД, архитектуры DWH/витрин данных и ETL/ELT-процессов
  • инструменты: Опыт использования планировщиков задач (Airflow или аналоги)
  • проактивность: желание развиваться в области инженерии данных, учиться новому и самостоятельно решать сложные проблемы.
  • коммуникация и командная работа: способность не только самостоятельно решать задачи, но и эффективно взаимодействовать с другими командами, вы умеете аргументированно доносить свою позицию, договариваться с внутренними бизнес-заказчиками и поставщиками сервисов и координировать совместную работу для достижения общей цели.
  • английский: свободное чтение технической документации
  • навыки работы с генеративными AI-моделями; опыт
  • создания AI-агентов и использования их в работе будет преимуществом
  • опыт использования GigaChat, Kandinsky и аналогов в продуктах, навыки создания и использования AI-агентов
  • инструментальное владение AI для анализа, генерации и автоматизации

Условия

  • офисный формат (Поклонная 3к1)
  • ежегодный пересмотр зарплаты и годовая премия
  • расширенный ДМС и льготное страхование для семьи
  • уникальная система обучения Сбера для профессионального и карьерного развития
  • выгодная ипотека для сотрудников
  • подписка Прайм с возможностью совместного использования на трёх близких
  • вознаграждение за рекомендацию друзей в команду Сбера
  • корпоративная пенсионная программа.
hh.ru
itransition

Data Engineer Middle

itransitionНа сервисе с: 01.08.26 20:47↑ Вакансия с автоподнятием
Зарплата не указанаГрузияТбилисиУдалёнка

Itransition is looking for a talented Data Engineer that is willing to solve complex technical issues while developing high quality software systems using modern technologies.

Requirements:

  • 2+ years with Python including strong knowledge of data libraries (pandas, multiprocess, Google Cloud SDK)

  • 2+ years of experience in ETL/ELT technologies (REST API, GraphQL, DBT, etc. ) and data pipeline orchestration (e.g., Airflow, Astronomer, DBT cloud, etc)

  • Hands-on experience with Snowflake

  • Problem-solving and root cause analysis in live production systems along with experience querying and transforming large volumes of data, data quality and data validation

  • Experience in SQL (SQL Server, Oracle, MySQL, BigQuery, Snowflake)

  • Comfortable working with serialized data format (JSON, AVRO, XML, CSV) as well as compressed and encoded files

  • Comfortable with ingesting data using REST APIs, data transformations and data loading/unloading techniques

  • English proficiency sufficient to work in an international environment

Nice to have:

  • Capable of designing and implementing data pipelines over cloud architecture
  • Experience working with CI/CD deployments
  • Experience working with GIT

We can offer:

  • Projects for such clients as PayPal, Wargaming, Xerox, Philips, adidas and Toyota
  • Competitive compensation that depends on your qualification and skills
  • Career development system with clear skill qualifications
  • Options to work remotely
  • Compensation for medical expenses
  • English courses online
  • Corporate parties and events for employees and their children
  • Internal conferences, workshops and meetups for learning and experience sharing
  • Gym membership compensation, corporate sport competitions (cybersport included)
  • 5 days of paid sick leave per year with no obligation to submit a sick-leave certificate

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.