Опубликовано 25 июня 2026 г.

Data Engineer (Python + Spark) в X5 Tech Москва

Building iconв офис
Money bag iconне указана

Data Engineer в команду ML-системы для детекции Out-of-stock ситуаций и аномалий в продажах. Разработка end-to-end пайплайнов для сбора, очистки и подготовки данных для моделей машинного обучения.

Задачи:

  • Разрабатывать и оптимизировать Spark-пайплайны для обработки данных в масштабе (200+ млн строк ежедневно)
  • Настраивать хранение и доступность данных в DWH
  • Автоматизировать интеграцию данных: продажи, акции, цены, остатки, погода, календари
  • Работать в связке с Data Science-командой, обеспечивая стабильный и качественный поток данных для моделей
  • Участвовать в развитии платформы прогнозирования спроса, делая её более надёжной, масштабируемой и удобной

Требования:

  • PySpark{2,3} / Spark SQL
  • Hadoop / Hive / Trino / S3 / clickhouse / postgres/ greenplum
  • Airflow
  • Python3
  • Docker, YARN / k8s
  • pytest

Навыки:

  • PySpark
  • Spark SQL
  • Hadoop
  • Hive
  • Trino
  • S3
  • ClickHouse
  • PostgreSQL
  • Greenplum
  • Airflow
  • Python
  • Docker
  • YARN
  • Kubernetes
  • pytest
Эту вакансию мы нашли в Telegram-канал
XT

X5 Tech

Москва

Получить оффер

Похожие вакансии

Это единственная вакансия по вашему фильтру

Не то, что искал?

Автоотклики