Опубликовано 25 июня 2026 г.
Data Engineer (Python + Spark) в X5 Tech Москва
Data Engineer в команду ML-системы для детекции Out-of-stock ситуаций и аномалий в продажах. Разработка end-to-end пайплайнов для сбора, очистки и подготовки данных для моделей машинного обучения.
Задачи:
- Разрабатывать и оптимизировать Spark-пайплайны для обработки данных в масштабе (200+ млн строк ежедневно)
- Настраивать хранение и доступность данных в DWH
- Автоматизировать интеграцию данных: продажи, акции, цены, остатки, погода, календари
- Работать в связке с Data Science-командой, обеспечивая стабильный и качественный поток данных для моделей
- Участвовать в развитии платформы прогнозирования спроса, делая её более надёжной, масштабируемой и удобной
Требования:
- PySpark{2,3} / Spark SQL
- Hadoop / Hive / Trino / S3 / clickhouse / postgres/ greenplum
- Airflow
- Python3
- Docker, YARN / k8s
- pytest
Навыки:
- PySpark
- Spark SQL
- Hadoop
- Hive
- Trino
- S3
- ClickHouse
- PostgreSQL
- Greenplum
- Airflow
- Python
- Docker
- YARN
- Kubernetes
- pytest
Эту вакансию мы нашли в Telegram-канал
XT
X5 Tech
Москва
Похожие вакансии
Это единственная вакансия по вашему фильтру
Не то, что искал?