vk

Ведущий инженер данных (Python)

Ищем DWH Engineer для команды VK Видео — одного из крупнейших и самых популярных видеосервисов в России!

vk · На сервисе с: 22.06.26 01:14

↑ Вакансия с автоподнятием
Зарплата не указанаРоссияМосква

Ищем DWH Engineer для команды VK Видео — одного из крупнейших и самых популярных видеосервисов в России!

Задачи

  • Разрабатывать и поддерживать процессы обработки и доставки данных для аналитических и ML команд
  • Собирать витрины, оптимизировать
  • Писать адхоки и выгрузки, раздебаги
  • Собирать требования

Требования

  • Понимание работы параллельных вычислений на кластере
  • Опыт с Airflow, Spark, Hadoop, ClickHouse, YT (опционально)
  • Знание Python: алгосы базовые (для понимания оптимального кода), классы и прочий сложный код (для чтения исходников и создания велосипедов типа операторов/сервисов)
  • Знание Git и работа с кодом в команде (ревью)

Похожие вакансии Data Engineer

Соц.сети
О

DataOps

ооо_7_красных_линийНа сервисе с: 02.10.26 20:22
200k–250k ₽Не указана странаЛокация не указанаУдалёнка

Публикатор: ••••••••
Обсуждение: ••••••••
#вакансия #devops #data #инженер #DWH #ETL #девопс #AI #ИИ

Должность: DataOps
Занятость: полная
Компания: ООО «7 Красных Линий»
Оклад на руки: 200-250К
Формат работы: удалённо
Оформление: ТК РФ
Заработная плата: обсуждается по итогам собеседования
Контактная информация
Telegram: ••••••••
Эл. почта: ••••••••
О компании
7 КРАСНЫХ ЛИНИЙ — AI-интегратор нового поколения. С 2016 года мы реализуем сложные IT-проекты для крупных компаний, а сегодня активно развиваем направления AI, Data и интеллектуальной автоматизации.
Чем предстоит заниматься
• Развивать и поддерживать IT-инфраструктуру, обеспечивать стабильность и отказоустойчивость систем.
• Настраивать и сопровождать процессы CI/CD, автоматизировать развёртывание и эксплуатацию сервисов.
• Работать с контейнеризацией и оркестрацией на базе Docker и Kubernetes.
• Автоматизировать инфраструктурные и эксплуатационные задачи с использованием Ansible, Bash и Python.
• Администрировать базы данных, обеспечивать резервное копирование, восстановление и мониторинг.
• Поддерживать и оптимизировать процессы загрузки, преобразования и обработки данных (ETL).
• Участвовать в развитии хранилищ данных (DWH) и витрин данных.
• Настраивать мониторинг, алертинг и диагностику инфраструктуры и сервисов.
• Анализировать и устранять проблемы производительности, загрузки и обработки данных.
• Использовать AI-инструменты и AI-агентов для автоматизации рутинных DevOps-задач и повышения эффективности работы.
Наши ожидания
• Опыт работы в DevOps и/или Data Engineering от 4 лет с практическими навыками в обоих направлениях.
• Уверенное владение Linux (Ubuntu/Debian, CentOS/RHEL).
• Опыт работы с Docker, Kubernetes и Helm.
• Практический опыт работы с Ansible и CI/CD на базе GitLab.
• Навыки автоматизации с использованием Bash и Python.
• Уверенное владение SQL и опыт работы с PostgreSQL.
• Опыт работы с одной или несколькими СУБД: PostgreSQL, ClickHouse, Greenplum.
• Понимание принципов построения хранилищ данных (DWH) и организации ETL-процессов.
• Опыт работы с Apache NiFi и/или Apache Airflow.
• Опыт настройки мониторинга и алертинга (Grafana, Prometheus или аналоги).
• Понимание сетевых технологий и протоколов TCP/IP, HTTP, DNS.
• Умение самостоятельно решать технические задачи и взаимодействовать с проектной командой.
Будет плюсом
• Практический опыт разработки ETL-процессов, хранилищ и витрин данных.
• Опыт работы с Python-библиотеками SQLAlchemy и Pandas.
• Знакомство с продуктами Arenadata (ADB, ADS, ADH).
• Опыт работы с Hadoop, PySpark или Apache Kafka.
• Опыт работы с Terraform и OpenStack.
• Опыт настройки высокодоступных и масштабируемых систем.
• Понимание принципов Data Quality и опыт автоматизации проверок качества данных.
• Практический опыт использования AI/LLM-инструментов и AI-агентов для автоматизации инженерных задач.

Соц.сети
A

Data Engineer

appsteroНа сервисе с: 02.10.26 18:17
Зарплата не указанаПольшаWarsawГибрид

🚀 В Appstero ищем Data Engineer

Ищем инженера, который построит и будет развивать аналитическое хранилище компании на BigQuery.

Что предстоит делать:
• Настраивать пайплайны из продуктовых и маркетинговых источников: AppsFlyer, Adjust, RevenueCat, Amplitude, Mixpanel, Facebook Ads и других
• Приводить данные в удобный вид для аналитиков и продактов, документировать модель данных
• Внедрять лучшие практики: слои (raw / staging / marts), нейминг, версионирование, тесты качества данных
• Общаться с продуктом, маркетингом и аналитикой и переводить их вопросы в структуру данных

От тебя:
✅ 2+ года в data engineering или в аналитике с серьёзной инженерной частью (junior+ / middle-)
Уверенный Python для ETL/ELT, работы с API и автоматизации, с опытом продакшн-кода
✅GCP: BigQuery, Cloud Functions, Cloud Storage
✅Уверенный SQL: оконные функции, CTE, оптимизация запросов
✅ Понимание принципов хранилищ: слои, нормализация и денормализация, идемпотентность, инкрементальные загрузки
✅Опыт интеграции внешних источников через API или готовые коннекторы
✅Умение говорить с нетехническими коллегами простым языком: половина работы — договориться, какие данные нужны и в каком виде
✅ Git, код-ревью

Что предлагаем:
- Гибрид: 2 дня в офисе в Варшаве, 3 дня удаленно
- Обеды в офисные дни
- Выездные тимбилдинги и ивенты в течение года
- Молодая команда без бюрократии и микроменеджмента

📩 Откликнуться: ••••••••

Другие площадки
choiceit

Middle / Senior Data Engineer

choiceitНа сервисе с: 02.10.26 17:17
Зарплата не указанаСербияBelgradeУдалёнка

Ищем Data Engineer в крупную технологическую компанию, которая разрабатывает высоконагруженные платформенные продукты для международных рынков в entertainment-индустрии.

Внутри — развитое data-направление и задачи, связанные с построением и развитием современной платформы данных. Ищем инженера, который умеет самостоятельно проектировать надежные data pipelines, уверенно работает с DWH и понимает, как устроены production-процессы работы с большими объемами данных.

Чем предстоит заниматься

— проектировать, разрабатывать и развивать data pipelines;  

— работать с DWH: моделями данных, слоями, витринами и ETL/ELT-процессами;  

— писать и оптимизировать сложные SQL-запросы;  

— разрабатывать на Python инструменты и сервисы для работы с данными;  

— поддерживать и развивать production-пайплайны;  

— работать с большими объемами данных и распределенной обработкой;

— следить за качеством и надежностью данных;  

— участвовать в выборе технических решений и развитии data-платформы;  

— взаимодействовать с аналитиками, разработчиками и другими продуктовыми командами.

Для Senior-уровня также важен опыт самостоятельного проектирования архитектурных решений и способность брать ответственность за технический подход к задаче.

Что для нас важно

— очень хорошее знание SQL и опыт работы со сложными запросами и большими объемами данных;  

— уверенный Python: не только небольшие скрипты, но и production-код, библиотеки или внутренние инструменты;  

— хорошее понимание принципов построения DWH;  

— опыт проектирования и разработки ETL/ELT-процессов;  

— понимание моделирования данных, построения витрин и контроля качества данных;  

— умение самостоятельно разбираться в задаче и предлагать техническое решение.

Желательно

— практический опыт с Airflow: разработка и поддержка DAG, scheduling, retries, backfill, monitoring;  

— опыт с dbt или похожими инструментами трансформации данных;  

— опыт со Spark и понимание распределенной обработки данных;  

— работа с аналитическими СУБД: ClickHouse, Greenplum, Vertica или другими MPP/OLAP-системами.

Будет плюсом

— Kafka;  

— Iceberg;  

— Trino;  

— Docker / Kubernetes;  

— CI/CD;  

— понимание подходов Data Mesh;  

— участие в open-source или собственные технические проекты.

Условия

— full-time;  

— удаленный формат работы;  

— гибкое начало рабочего дня;  

— корпоративная техника;  

— испытательный срок 3 месяца;  

— расширенный пакет бенефитов после испытательного срока: медицинская страховка, бюджет на спорт / языки / дополнительное медицинское покрытие, дополнительные оплачиваемые дни отдыха;  

— внутренние технические встречи, тренинги и возможность участия в профессиональных конференциях и обучении.

Процесс

Знакомство с рекрутером → короткий технический скрининг → технические секции по SQL, DWH и Python → для кандидатов Senior-уровня дополнительная секция по архитектуре и проектированию → встреча с командой.

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.