lamoda

Senior Big Data Engineer (Python, Java)

💰По итогам собеседования (ср. рын. зп 300 000 ₽ – 420 000 ₽)

lamoda · На сервисе с: 25.09.26 18:14

300k–420k ₽РоссияМоскваОфис

Senior Big Data Engineer в Lamoda

💰По итогам собеседования (ср. рын. зп 300 000 ₽ – 420 000 ₽)

📌Условия и бонусы:
Фултайм, офис (МСК).

📌Наши ожидания:
– Kubernetes — понимание ресурсной модели, просмотр конфигураций, troubleshooting;
– Опыт работы с Hadoop (HDFS, Hive Metastore);
– Опыт работы со Spark (spark SQL, streaming, понимание ньюансов работы с pyspark);
– Apache Icberg – владение процедурами, snapshots, maintenance;
– Глубокое понимание Airflow (2, 3) – идемпотентность, assets, backfills;
– Уверенное знание Git, CI/CD;
– Python, Scala/Java – ООП, проектирование библиотек, интеграционные/юнит тесты.

✍🏼••••••••

Похожие вакансии Data Engineer

Соц.сети
A

Data / ML Platform Engineer (Middle+ / Senior)

astratechНа сервисе с: 25.09.26 20:59
280k–400k ₽РоссияМоскваГибрид

#вакансия #mlops #dataengineering #healthtech #fulltime #москва

Вакансия: Data / ML Platform Engineer (Middle+ / Senior)
Компания: AstraTech
Формат: гибридный / удаленный по РФ
Локация: Москва
Занятость: full-time
Вилка: 280 000 - 400 000 ₽ гросс

HealthTech стартап создает продукт поддержки врачебных решений, который делает процессы в здравоохранении эффективнее и помогает врачам принимать более точные решения 🕊

Сейчас команда строит Data Platform и ML / LLM Platform. Это единый путь данных: от загрузки из разных источников до измеренного результата модели. Команда ищет инженера, который возьмет на себя подготовку данных и инструменты для ML-команды и сможет сам проводить эксперименты с моделями.

Вам предстоит:
— Разрабатывать Python / SQL-пайплайны загрузки и обработки данных из файлов, API и информационных систем.
— Проектировать таблицы хранилища: сущности, связи, правила преобразования.
— Встраивать псевдоанонимизацию и проверки качества в потоки данных.
— Готовить признаки и версионируемые train/validation/test-выборки.
— Обеспечивать прослеживаемость и воспроизводимость ML / LLM-экспериментов.
— Вместе с ML-командой развивать оценку моделей, подготовку данных для RAG и дообучения.

Ожидаем от вас:
— Уверенные Python и SQL, поддерживаемый код за пределами ноутбуков.
— Практический опыт ETL / ELT: оркестрация, инкрементальная обработка, повторные запуски.
— Опыт с S3, Parquet, pandas / Polars / PyArrow.
— Понимание жизненного цикла ML: выборки, baseline, метрики, проверка утечек.
— Опыт с MLflow, ClearML или аналогами; Linux, Git, Docker, CI/CD.
— Умение работать с чувствительными данными.

Будет плюсом:
— Опыт с медицинскими данными, МИС и клиническими справочниками.
— Практический NLP / LLM: извлечение данных из текста, embeddings, RAG.
— PyTorch / Hugging Face, дообучение и inference на GPU.
— Опыт превращения исследовательского прототипа в регулярный пайплайн.

Почему интересно:
— Проект, который действительно приносит пользу людям.
— Возможность строить платформу с нуля и влиять на архитектуру.
— Работа на стыке Data Engineering, MLOps и LLM с современным стеком.

Направляйте ваши отклики с резюме - •••••••• 📩

Соц.сети
T

Senior Data Engineer (AI / LLM focus)

topselectionНа сервисе с: 25.09.26 16:25
350k–400k ₽РоссияУдалёнка

#вакансия #dataengineer #python #sql #llm #rag #ai #data #удаленка #работа #itвакансии #senior

🚀 Senior Data Engineer (AI / LLM focus) | компания TopSelection
📍 РФ | Удалённо / Офис по желанию | Проектная роль
Ищем сильного Data-инженера для прототипирования корпоративных AI-ассистентов.
Это роль на стыке классического DE и AI: нужно не просто строить пайплайны, но и готовить контекст для LLM, оценивать качество RAG и бороться с галлюцинациями.

🎁 Условия:
💰 Условия: 350 000 – 400 000 ₽ Gross
🌍 Удаленно: Полная свобода выбора формата: удалёнка из любого города РФ или офис (по желанию).
📃Оформление: по договору ИП

🛠 Кого мы ищем:
• 5+ лет опыта в Data Engineering / разработке аналитических решений.
• Уверенный Python и SQL, опыт с API, ETL/ELT, DWH.
• Понимание принципов LLM, RAG, retrieval, embeddings (опыт работы — жирный плюс, но если глубоко погружен в тему — welcome).
• Умение быстро собирать PoC, исследовать источники и находить нестандартные решения.

⚙️ Что предстоит делать:
• Готовить данные (API, SQL, файлы) и собирать прототипы для AI-ассистента до передачи в продакшен.
• Подготавливать контекст для RAG, тестировать поиск и сопоставление сущностей.
• Формировать golden dataset и автоматизировать тестирование ассистента (массовый прогон сценариев).
• Считать метрики качества (retrieval, hallucinations) и локализовывать причины ошибок.

📩 Как откликнуться: •••••••• c пометкой Data Engineer (AI / LLM focus)

⚠️Убедительная просьба ознакомиться с правилами безопасности при отклике на вакансии в Телеграме. Последнее время увеличилось число мошеннических схем, когда мошенники прикрываются работодателем

••••••••

hh.ru
сбер. it

Data engineer

сбер. itНа сервисе с: 25.09.26 15:23
Зарплата не указанаРоссияМоскваОфис

Мы — команда, отвечающая за функционирование и бесперебойную поставку данных в аналитическую платформу данных розничного бизнеса на базе Greenplum и ClickHouse (промышленные витрины и лаборатория данных для аналитиков, объем данных – сотни Тб). Наша работа — это фундамент, на котором аналитики и data scientists строят свои модели и принимают ключевые бизнес-решения. Мы ищем коллегу, который поможет нам поддерживать и развивать платформу, автоматизировать процессы обработки данных и следить за качеством информации.

Обязанности

  • обеспечивать поставку данных: загружать данные на платформы Greenplum и Clickhouse с помощью наших внутренних инструментов. создавать собственные инструменты для поставки данных
  • управлять платформой: разрабатывать и внедрять сервисы для автоматизации управления платформой: вакуум, сбор статистики, удаление ненужных таблиц, оптимизация физ.дизайна, выявление токсичной активности и т.д
  • мониторить и оптимизировать: отслеживать состояние ETL-процессов в Airflow и собственных решениях) реагировать на сбои, находить и устранять "бутылочные горлышки" в дата-пайплайнах для ускорения загрузки
  • автоматизировать рутину: писать скрипты на Python для автоматизации повторяющихся задач по обработке данных
  • вести документацию: разрабатывать и поддерживать техническую документацию и базу знаний по нашим процессаму
  • участвовать в R&D: тестировать новые технологии и инструменты для улучшения нашей платформы данных.

Требования

  • опыт работы: не менее 2 лет в качестве Data Engineer / ETL Developer
  • python: написание дагов в Airflow, асинхронность (asyncio), взаимодействие через драйверы (psycopg2, clickhouse-driver), pandas, работа с API, веб-сервисы (FastAPI)
  • SQL: Уверенное владение: сложные запросы, оконные функции, CTE, умение читать планы выполнения, оптимизация запросов
  • СУБД: Знание архитектуры и опыт работы с МРР СУБД (Greenplum, Teradata, Exadata)
  • DWH/ETL: Знание современных принципов обработки данных Опыт разработки ETL-процессов, построения хранилищ и витрин данных
  • теоретическая база: Понимание принципов работы реляционных СУБД, архитектуры DWH/витрин данных и ETL/ELT-процессов
  • инструменты: Опыт использования планировщиков задач (Airflow или аналоги)
  • проактивность: желание развиваться в области инженерии данных, учиться новому и самостоятельно решать сложные проблемы.
  • коммуникация и командная работа: способность не только самостоятельно решать задачи, но и эффективно взаимодействовать с другими командами, вы умеете аргументированно доносить свою позицию, договариваться с внутренними бизнес-заказчиками и поставщиками сервисов и координировать совместную работу для достижения общей цели.
  • английский: свободное чтение технической документации
  • навыки работы с генеративными AI-моделями; опыт
  • создания AI-агентов и использования их в работе будет преимуществом
  • опыт использования GigaChat, Kandinsky и аналогов в продуктах, навыки создания и использования AI-агентов
  • инструментальное владение AI для анализа, генерации и автоматизации

Условия

  • офисный формат (Поклонная 3к1)
  • ежегодный пересмотр зарплаты и годовая премия
  • расширенный ДМС и льготное страхование для семьи
  • уникальная система обучения Сбера для профессионального и карьерного развития
  • выгодная ипотека для сотрудников
  • подписка Прайм с возможностью совместного использования на трёх близких
  • вознаграждение за рекомендацию друзей в команду Сбера
  • корпоративная пенсионная программа.

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.