Опубликовано 3 дня назад

Software Engineer в ПАО Сбербанк Москва

Building iconв офис
Money bag iconне указана

Сопроводительное письмо под эту вакансию

Софи напишет его под твоё резюме. Бесплатно — 5 писем в день.

Software Engineer в Data Conveyor Team Центра робототехники Сбера. Задача — превращать записи с роботов и внешние датасеты в проверяемый и воспроизводимый формат для обучения ML-моделей.

Задачи:

  • Проектировать и реализовывать пайплайны, превращающие данные из разных источников в формат, пригодный для обучения моделей
  • Стабилизировать основной путь конвертации данных с роботов: единый поддерживаемый процесс, проверяемые результаты, повторяемые запуски и понятные отчёты об ошибках
  • Поддерживать dataset schema, versioning, compatibility checks, validators и manifests
  • Подключать новые источники данных: записи с роботов, внешние датасеты, симуляции, egocentric data, данные тестовых запусков и корректирующих демонстраций
  • Обеспечивать reproducible dataset builds и связь source data -> converted episodes -> filtered dataset -> dataset release -> training run -> benchmark result
  • Создавать validation suite: проверка файлов, video/parquet layout, timestamps, required fields, metadata, annotation status и known historical variants
  • Готовить данные к передаче в обучение так, чтобы ML-команды понимали состав датасета, ограничения, версию и качество
  • Делать надёжные CLI/tools, тесты, runbooks и отладочные отчёты для исследователей и инженеров

Требования:

  • Сильный Python и опыт разработки batch / data processing pipelines
  • Опыт backend, data engineering или software engineering для внутренних платформ и ML/data workflows
  • Опыт работы с большими файлами, metadata manifests, reproducible builds и validation logic
  • Практический опыт с Linux, Docker, Git, CI/CD и командной строкой
  • Понимание storage и data formats: S3/object storage, network storage, parquet, zarr, hdf5, webdataset, video files или аналогичные форматы
  • Умение разбираться в нестандартных форматах данных и приводить их к строгому контракту
  • Готовность писать поддерживаемый production-like код, а не одноразовые conversion scripts

Условия:

  • Офисный формат работы, адрес офиса Автозаводская 23а к2
  • Ежегодный пересмотр зарплаты, квартальная и годовая премия
  • Корпоративный спортзал и зоны отдыха
  • Более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
  • Программа адаптации и помощь руководителя на старте
  • Расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
  • Гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
  • Подписка Прайм с возможностью совместного использования на трёх близких
  • Вознаграждение за рекомендацию друзей в команду Сбера

Навыки:

  • Python
  • batch processing
  • data processing pipelines
  • backend
  • data engineering
  • Linux
  • Docker
  • Git
  • CI/CD
  • S3
  • object storage
  • network storage
  • parquet
  • zarr
  • hdf5
  • webdataset
  • video files
  • LeRobot
  • RLDS
  • DROID
  • Bridge
  • RT-X
  • ROS bags
  • robotics trajectories
  • Ray
  • Airflow
  • Prefect
  • Kubernetes
  • SLURM
  • LSF
  • W&B
  • MLflow
  • Hydra
  • experiment tracking
  • computer vision
  • multimodal data
  • VLA
  • imitation learning
  • robot learning
  • GigaChat
  • Kandinsky
  • AI-агенты
Эту вакансию мы нашли в sber
ПАО Сбербанк

ПАО Сбербанк

Москва

Получить оффер

Зарплата vs рынок

Зарплата не указана. Обычно на такой позиции платят 160 000 – 440 000 ₽, медиана 270 000 ₽.

85k270k1,0M

обычно платят (p25–p75): 160 000 – 440 000 ₽

Когорта Data · 631 вакансия за 90 дней

Зарплаты Data

Похожие вакансии

Это единственная вакансия по вашему фильтру

Не то, что искал?

Автоотклики