Опубликовано 14 дней назад

DataOps в Медиалогия Москва

Building iconв офис
Person iconmiddle
Money bag iconне указана

Медиалогия занимается разработкой продуктов по сбору и анализу данных из СМИ и соцмедиа.

Мы разрабатываем высоконагруженные системы, которые в режиме реального времени сканируют весь текстовый сегмент Интернета (100+ млн. сообщений в сутки, 1.7 млрд. метрик) и, используя уникальные лингвистические технологии, позволяют осуществлять мгновенный анализ упоминаний наших клиентов в социальных сетях, блогах, форумах и управлять их репутацией.



Что предстоит делать:

  • Обеспечивать полный цикл жизни реляционных (PostgreSQL, MySQL) и колоночных (Clickhouse) баз данных: от установки до тюнинга и масштабирования.
  • Проектировать и поддерживать отказоустойчивые кластеры брокеров сообщений (Kafka, RabbitMQ) под высокие нагрузки.
  • Управлять инфраструктурой BigData и системами потоковой обработки (Hadoop, NiFi, AirFlow), оптимизировать их производительность.
  • Настраивать и поддерживать системы кэширования и поиска (Redis, Elasticsearch).
  • Управлять S3-совместимым объектным хранилищем (MinIO), обеспечивать георезервирование и консистентность данных.
  • Настраивать надежные системы резервного копирования (бэкапы, PITR) и регулярно проверять планы аварийного восстановления (DR).
  • Выступать «куратором» 1-2 проектов: погружаться в бизнес-логику, помогать разработчикам с профилированием сложных запросов и проектированием схем данных.



Наш стэк:

  • БД: PostgreSQL, MySQL, Clickhouse.
  • Очереди и брокеры: Kafka, RabbitMQ.
  • BigData & ETL: Hadoop, Apache NiFi, Airflow.
  • Смежные системы: Redis, Elasticsearch, MinIO.

Требования к кандидату

  • Глубокое понимание внутреннего устройства реляционных БД (особенно PostgreSQL или MySQL): механизмы блокировок, индексы, репликация (streaming, logical).
  • Реальный опыт эксплуатации Apache Kafka в Production (настройка партиций, retention, решение проблем с лагом консьюмеров).
  • Опыт работы с Clickhouse (шардирование, репликация, движки таблиц).
  • Уверенное администрирование Linux (настройка ядра, дисковой подсистемы, сети под высокие нагрузки баз данных).
  • Опыт настройки высокодоступных (HA) конфигураций для БД (Patroni, PXC и т.д.).

    Будет плюсом:
  • Опыт эксплуатации стека Hadoop (HDFS, YARN) и инструментов ETL (Apache NiFi).
  • Навыки работы с Elasticsearch (управление индексами, ILM, масштабирование кластера).
  • Опыт деплоя стейтфул-приложений (баз данных, очередей) внутри Kubernetes с использованием Operators.
  • Навыки написания Ansible-ролей для автоматизации раскатки БД.
  • Умение писать скрипты на Python или Bash для автоматизации рутинных задач DBA.

Условия:

  • ДМС после испытательного срока;
  • специальные условия для сотрудников на страхование для членов семьи;
  • скидки в компаниях-партнерах (фитнес-центры, обучающие курсы, изучение иностранных языков и многое другое);
  • бесплатное онлайн-обучение на корпоративном портале и корпоративная библиотека;
  • офис в пешей доступности от ст. м. Дмитровская (БЦ «Савеловский Сити»).
Эту вакансию мы нашли в HH.ru
МЕ

Медиалогия

Москва

Получить оффер

Похожие вакансии

Это единственная вакансия по вашему фильтру

Не то, что искал?

вакансии джуниор
как откликнуться на вакансию
примеры вакансий junior
вакансии по Python
стажировки по Python
Автоотклики