яндекс

Инженер данных в Финтех (Python)

В Финтехе мы создаём платёжные продукты, сервисы и инструменты для управления личными финансами. Финтех уже превратился из стартапа в полноценный и крайне важный продукт.

яндекс На сервисе с: 22.06.26 04:44

↑ Вакансия с автоподнятием
Зарплата не указанаНе указана странаЛокация не указана

В Финтехе мы создаём платёжные продукты, сервисы и инструменты для управления личными финансами. Финтех уже превратился из стартапа в полноценный и крайне важный продукт.

Сейчас мы собираем новое — аналитическое — хранилище данных и формируем для этого команду. В хранилище нет легаси, поэтому у вас будет возможность оказаться у истоков нового проекта. У нас большие планы — приходите помогать их реализовать!

Строить ETL-процессы

Нужно извлекать из источников ценную информацию, обрабатывать её и представлять в виде, удобном для аналитиков. Сложность пайплайнов может варьироваться от простых инжестов данных из внешней среды и приземления результата в хранилище до витиеватых графов со множеством инпутов и аутпутов.

Оптимизировать логику

Как известно, у нас нет собственного легаси, но мы часто работаем с прототипами, реализованными аналитиками, чьё представление о прекрасном может не совпадать с нашим. Поэтому мы распутываем нетривиальную логику и предлагаем более строгую, консистентную и оптимальную, ориентируясь на большие объёмы данных.

Обеспечивать доступность сервиса

Олимпиадный подход подразумевает одноразовость результата. Мы преследуем совсем другие цели, поэтому максима «сработало раз — и ладно» не о нас. Идеал такой: хранилище обеспечивает регулярную поставку с минимально возможным количеством сбоев, а данные — корректны, полны, непротиворечивы и отвечают самым строгим стандартам качества.

Проектировать структуру хранилища

Лучшее аналитическое DWH ещё только в планах. Мы хотим заложить основы, которые позволят ему быстро развиваться, обрастая при этом не «костылями» и «велосипедами», а современными инженерными практиками и подходами.

Взаимодействовать с аналитиками

Они наши главные и любимые заказчики. Вместе с ними вам предстоит обдумывать бизнес-задачи, иногда вы будете спорить, но в итоге — находить оптимальные решения. Неотъемлемая часть этого процесса — накапливание личного опыта в бизнес-домене Финтеха. Прибавим сюда рост инженерного опыта — и получим двойную выгоду. Почти как у Яндекс Пэй.

* Уверенно программируете на Python
* Хорошо знаете SQL и понимаете устройство современных СУБД
* Понимаете и можете объяснить необходимость непрерывной интеграции и доставки (CI/CD), преимущества использования систем контроля версий, код-ревью, тестирования и мониторинга
* Работаете в командной строке Unix-подобных систем (Linux, macOS)

* Создавали сложные высоконагруженные ETL- и ELT-процессы (Hadoop, Hive, Spark)
* Разрабатывали процессы обработки событий, приближенные к реальному времени (Kafka, Spark Streaming, Flink)
* Участвовали в проектировании хранилищ данных
* Работали по методологии Agile
* Руководили стажёрами или начинающими специалистами
* Знакомы со специализированными аналитическими БД (Greenplum, Vertica, ClickHouse, Teradata) и аналитическими инструментами на базе Python (Jupyter, pandas, SciPy, Matplotlib)
* Публикуете свой код в доступном репозитории, пишете статьи, выступаете на конференциях

Похожие вакансии Data Engineer

hh.ru
domeo
Зарплата не указанаРоссияМоскваОфис

Компания DOMEO - Российская компания, лидер среди сервисов по капитальному ремонту и дизайну квартир и частных домов.
На рынке мы уже более 10 лет и на сегодняшний день представлены в трех городах Москва, Санкт-Петербург, Сочи.

Мы строим PIM-систему - единое хранилище всех товаров. Ищем Database Engineer, который спроектирует для нее базу данных.

Что предстоит делать:

  • Проектировать и поддерживать базы данных PostgreSQL;

  • Оптимизировать производительность: индексы, партиционирование, настройка БД;

  • Управлять миграциями (Alembic) с возможностью обновления без остановки;

  • Настраивать репликацию, бэкапы и мониторинг;

  • Дорабатывать продукт по итогам разбора инцидентов;

Требования:

  • Опыт проектирования схем БД для высоконагруженных систем;

  • Опыт работы с PostgreSQL от 3 лет;

  • Уверенное владение SQL (сложные запросы, оконные функции);

  • Опыт оптимизации производительности (индексы, EXPLAIN);

  • Понимание партиционирования больших таблиц;

  • Опыт работы с большими таблицами (миллионы записей);

  • Python (для скриптов и ETL);

  • Опыт с миграциями (Alembic / Flyway / Liquibase);

Будет плюсом:

  • Опыт мониторинга БД и разбора инцидентов;

  • Опыт нагрузочного тестирования;

  • Настройка репликации;

  • Docker, CI/CD;

  • Опыт в e-commerce, ритейле или PIM-системах;

Условия:

  • Формат работы: офисный;
  • График: на выбор - с 09:00 до 18:00 или с 10:00 до 19:00 (перерыв 1 час). Суббота, воскресенье и праздничные дни - выходные;
  • Офис: стильный и современный, в пешей доступности от метро «Шаболовская» (1 минута) и «Тульская» (15 минут);
  • Оборудованная кухня и уютные места для отдыха;
  • Для желающих - бесплатные занятия йогой в спортивном пространстве офиса;
  • Детская комната - если есть необходимость взять ребёнка с собой.
hh.ru
газпром нефть ит

Data Engineer junior+

газпром нефть итНа сервисе с: 05.10.26 10:41
Зарплата не указанаРоссияЕкатеринбургГибрид

В ООО "Газпромнефть-Региональные продажи" требуется дата-инженер

Обязанности:

  • Проектирование и реализация ELT/ETL-решений для загрузки сырых данных в Hadoop,
  • проектирование и реализация хранилищ и витрин данных в Hive, Hbase, SQL Server, PostgreSQL, Clickhouse и соответствующих ETL,
  • проектирование и реализация решений для межсистемной интеграции (rest, soap, MQ, ftp, etc) ,
  • оптимизация MVP-решения команд data scientist для переноса их в продуктив,
  • развитие архитектуры и оптимизация работы типовых решений на платформе,
  • участие в апробации и оптимизации новых компонент платформы,
  • анализ и оптимизация бизнес-требований, подготовка технической документации,
  • решение инцидентов эксплуатации систем и модулей.

Требования:

  • Опыт разработки решений на базе одной из СУБД: MSSQL Server,Oracle, PostreSQL, Clickhouse
  • Опыт интеграции с различными источниками данных (rest, soap, api, ftp, dfs, http, rdbms)
  • Участие в проектах построения корпоративного хранилища данных или BI системы для крупного бизнеса
  • ПО: Hadoop HBase/Hive/Spark/Scala, Informatica DEI/BDM/PC, Kafka
  • ЯП: SQL, Python
  • Командные оболочки: Bash, PowerShell
  • Devops: GitLab, Jira, Jenkins
  • Аналитический склад ума,
  • Умение работать в команде,
  • Умение быстро принимать верные решения в критических ситуациях,
  • Стремление к профессиональному росту

Условия:

  • Достойную заработную плату, годовую премию по результатам работы
  • Постоянный трудовой договор
  • Качественную программу ДМС со стоматологией с первого месяца работ
  • Неограниченный доступ к образовательному контенту на корпоративном портале знаний
  • Подписка на лучшие электронные библиотеки.
hh.ru
aston

Data Engineer / Дата инженер

astonНа сервисе с: 05.10.26 10:05
Зарплата не указанаРоссияМоскваУдалёнка

Aston — аккредитованная аутсорсинговая IT-компания, работающая с 2007 года. Наш штат насчитывает 2500+ специалистов. Мы разрабатываем программное обеспечение и IT-решения в сферах Finance, Healthcare, eCommerce, IoT, Media, Big Data, ML и многом другом.

Предлагаем присоединиться в роли Data Engineer и работать над проектом заказчика.

Заказчик - крупнейший коммерческий банк страны, лидер по объему активов и цифровому развитию. Активно продвигает мобильные сервисы, ценит скорость, гибкость и неформальный подход внутри команд. Многократно отмечен престижными наградами, в том числе «Bank of the Year in Russia 2019» (The Banker) и «Best Mortgage Bank in CEE» (Global Finance).

Чем предстоит заниматься?

  • реализовывать высоконагруженные конвейеры обработки данных для обеспечения надежной и бесперебойной репликации данных из ИТ-систем;
  • реализовывать комплексные задачи по подготовке данных в целевых аналитических хранилищах (DataLake, SandBox, FeatureStore) для построения признаков, необходимых для разработки моделей машинного обучения;
  • разрабатывать и поддерживать в актуальном состоянии документацию по разработанному функционалу;
  • своевременно отражать статусы выполнения задач в Jira;
  • проверять качество кода, написанного инженерами данных.


Чего мы ждем от специалиста?

  • опыт работы в роли Data Engineer от 4-х лет;
  • отличные знания Python: структуры данных и алгоритмов, ООП и функциональное программирование;
  • опыт написания модульных и интеграционных тестов, знание и опыт применения NumPy, Pandas;
  • опыт разработки и внедрения в промышленную эксплуатацию сервисов загрузки и обработки неструктурированных данных (текст, xml, json) из внешних источников;
  • способность разобраться с API поставщиков данных, используя доступную документацию;
  • отличное знание SQL: сложные запросы с использованием аналитических оконных функций, инструменты профилирования для оптимизации их производительности;
  • опыт работы с БД Oracle, Postgres, Greenplum;
  • опыт работы с инструментами разработки, планирования и мониторинга рабочих процессов (workflow engines) пакетной обработки данных Airflow;
  • опыт разработки сложных, высоконагруженных приложений обработки данных на основе PySpark;
  • опыт работы с Apache Kafka: продюсеры/консьюмеры на Python, consumer groups;
  • опыт разработки сервисов потоковой обработки данных с использованием инструментов Spark Structured Streaming, Flink;
  • опыт работы с Flink.

Что мы предлагаем?

  • Хорошая зарплата: уровень обсуждается индивидуально, есть доплаты за менторство и профактивности.

  • Развитие: долгосрочные проекты от российских заказчиков, возможность менять направления, прозрачная система Performance Review.

  • Комфорт и свобода: релокейт между офисами, выбор формата работы (удалённо, офис, гибрид), адаптация для новых сотрудников.

  • Обучение: доступ к корпоративному порталу, митапам, конференциям (и как гость, и как спикер).

  • Социальный пакет: ДМС со стоматологией, частичная компенсация спорта, бесплатный английский, оплачиваемый отпуск и больничные.

  • Корпоративная жизнь: тимбилдинги, детские праздники, внутренние мероприятия.

Наши офисы:

  • Москва (ул. Вильгельма Пика, 11, БЦ «Ботаника», 13 эт., оф. 1310),

  • Санкт-Петербург (Владимирский проспект, д. 23, 8 этаж),

  • Казань (Н. Ершова, 76/1),

  • Нижний Новгород (ул. Новая, 28, коворкинг "VMESTE").

Откликайтесь, если вы готовы расти и развиваться вместе с командой ASTON!
Наш рекрутер свяжется с вами, чтобы обсудить детали.

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.