Опубликовано 3 дня назад
Software Engineer в ПАО Сбербанк Москва
Сопроводительное письмо под эту вакансию
Софи напишет его под твоё резюме. Бесплатно — 5 писем в день.
Software Engineer в Data Conveyor Team Центра робототехники Сбера. Задача — превращать записи с роботов и внешние датасеты в проверяемый и воспроизводимый формат для обучения ML-моделей.
Задачи:
- Проектировать и реализовывать пайплайны, превращающие данные из разных источников в формат, пригодный для обучения моделей
- Стабилизировать основной путь конвертации данных с роботов: единый поддерживаемый процесс, проверяемые результаты, повторяемые запуски и понятные отчёты об ошибках
- Поддерживать dataset schema, versioning, compatibility checks, validators и manifests
- Подключать новые источники данных: записи с роботов, внешние датасеты, симуляции, egocentric data, данные тестовых запусков и корректирующих демонстраций
- Обеспечивать reproducible dataset builds и связь source data -> converted episodes -> filtered dataset -> dataset release -> training run -> benchmark result
- Создавать validation suite: проверка файлов, video/parquet layout, timestamps, required fields, metadata, annotation status и known historical variants
- Готовить данные к передаче в обучение так, чтобы ML-команды понимали состав датасета, ограничения, версию и качество
- Делать надёжные CLI/tools, тесты, runbooks и отладочные отчёты для исследователей и инженеров
Требования:
- Сильный Python и опыт разработки batch / data processing pipelines
- Опыт backend, data engineering или software engineering для внутренних платформ и ML/data workflows
- Опыт работы с большими файлами, metadata manifests, reproducible builds и validation logic
- Практический опыт с Linux, Docker, Git, CI/CD и командной строкой
- Понимание storage и data formats: S3/object storage, network storage, parquet, zarr, hdf5, webdataset, video files или аналогичные форматы
- Умение разбираться в нестандартных форматах данных и приводить их к строгому контракту
- Готовность писать поддерживаемый production-like код, а не одноразовые conversion scripts
Условия:
- Офисный формат работы, адрес офиса Автозаводская 23а к2
- Ежегодный пересмотр зарплаты, квартальная и годовая премия
- Корпоративный спортзал и зоны отдыха
- Более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
- Программа адаптации и помощь руководителя на старте
- Расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
- Гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
- Подписка Прайм с возможностью совместного использования на трёх близких
- Вознаграждение за рекомендацию друзей в команду Сбера
Навыки:
- Python
- batch processing
- data processing pipelines
- backend
- data engineering
- Linux
- Docker
- Git
- CI/CD
- S3
- object storage
- network storage
- parquet
- zarr
- hdf5
- webdataset
- video files
- LeRobot
- RLDS
- DROID
- Bridge
- RT-X
- ROS bags
- robotics trajectories
- Ray
- Airflow
- Prefect
- Kubernetes
- SLURM
- LSF
- W&B
- MLflow
- Hydra
- experiment tracking
- computer vision
- multimodal data
- VLA
- imitation learning
- robot learning
- GigaChat
- Kandinsky
- AI-агенты
Эту вакансию мы нашли в sber

ПАО Сбербанк
Москва
Зарплата vs рынок
Зарплата не указана. Обычно на такой позиции платят 160 000 – 440 000 ₽, медиана 270 000 ₽.
85k270k1,0M
обычно платят (p25–p75): 160 000 – 440 000 ₽
Когорта Data · 631 вакансия за 90 дней
Зарплаты Data →Похожие вакансии
Это единственная вакансия по вашему фильтру
Не то, что искал?
Похожие вакансии
- Databricks EngineerITBUSINESSMAN Sp. z o.o. · удалённо
- Junior Big Data Engineer (Java / Python)Allegro · Poznań · 257 000 – 350 000 ₽/мес
- Data EngineerWildberries · Москва
- Frontend-разработчик в Автоматизация внутренних процессовVK · Санкт-Петербург
- Middle+/Senior Fullstack C# (.NET) DeveloperIxora · удалённо · от 300 000 ₽/мес