Детский мир · Екатеринбург

Data Engineer (Hadoop / Spark) — Детский мир

Разрабатывать и оптимизировать batch-процессы на Apache Spark. Проектировать ETL/ELT-пайплайны для обработки больших объёмов данных. Создавать и поддерживать...

Компания набирает: 1065 вакансий

Коротко о вакансии

Зарплату работодатель не назвал — вилку обсуждают на собеседовании. Компания нанимает активно — открытых позиций сейчас 1065.

Описание вакансии

«Детмир Тех» развивает цифровую экосистему группы компаний «Детский мир». Мы создаём продукты для миллионов клиентов и сервисы, которые помогают бизнесу принимать решения на основе данных.

Ищем Data Engineer в команду Big Data Platform. Платформа построена на Hadoop 3 и Apache Spark и является основным источником данных для всей группы компаний.

Главная задача — развивать надёжную и производительную платформу обработки больших объёмов данных: проектировать пайплайны, оптимизировать Spark-приложения, развивать Data Lake и совершенствовать архитектуру Hadoop-кластера.

Чем предстоит заниматься:

  • Разрабатывать и оптимизировать batch-процессы на Apache Spark.
  • Проектировать ETL/ELT-пайплайны для обработки больших объёмов данных.
  • Создавать и поддерживать витрины данных в Hadoop.
  • Оптимизировать Spark jobs: partitioning, shuffle, data skew, использование памяти и ресурсов кластера.
  • Развивать архитектуру Data Lake и подходы к организации и хранению данных.
  • Организовывать загрузку и передачу данных через Kafka и S3 API (MinIO).
  • Автоматизировать процессы с помощью Apache Airflow и Apache NiFi.
  • Поддерживать трансформации данных в dbt Core.
  • Развивать и поддерживать витрины данных в ClickHouse.
  • Оптимизировать запросы и процессы загрузки данных в ClickHouse, разбираться с проблемами производительности.
  • Поддерживать аналитическую платформу на Apache Superset, решать возникающие технические проблемы.
  • Внедрять проверки качества данных и мониторинг пайплайнов.
  • Исследовать причины сбоев и деградации производительности.
  • Помогать аналитикам и дата-сайентистам эффективно работать с платформой.
  • Участвовать в развитии внутренних инструментов и стандартов Data Engineering.
  • Участвовать в развёртывании и эксплуатации компонентов платформы в Kubernetes.

Что для нас важно:

  • От трёх лет опыта работы с Hadoop и Apache Spark.
  • Знание основных компонентов Hadoop и принципов работы HDFS и Spark.
  • Глубокое понимание архитектуры Spark и принципов распределённых вычислений.
  • Опыт разработки и оптимизации Spark batch jobs.
  • Уверенное владение SQL.
  • Опыт проектирования DWH или Data Lake.
  • Опыт построения ETL/ELT-процессов.
  • Практический опыт работы с Apache Airflow.
  • Знание форматов хранения данных.
  • Понимание принципов партиционирования и организации данных в Data Lake.
  • Умение диагностировать проблемы с shuffle, partitioning, data skew, памятью и использованием ресурсов кластера.
  • Умение анализировать производительность распределённых приложений и находить узкие места.
  • Умение писать чистый, тестируемый и поддерживаемый код.
  • Готовность принимать технические решения и отвечать за результат.

Будет преимуществом:

  • Опыт разработки на Scala.
  • Знание Kafka и принципов потоковой обработки данных.
  • Опыт работы с ClickHouse и оптимизации запросов.
  • Опыт работы с Apache Superset.
  • Знакомство с Apache NiFi и dbt Core.
  • Опыт эксплуатации приложений в Kubernetes.
  • Знание Docker, Helm и GitLab CI/CD.
  • Опыт работы с DataHub или другими Data Catalog решениями.
  • Опыт построения мониторинга data-платформ и пайплайнов.
  • Знакомство с VictoriaMetrics, Grafana, Hue или Jupyter.
  • Опыт работы с большими Hadoop-кластерами и высокими объёмами данных.

Наш стек:

Хранение и обработка: Hadoop 3, HDFS, Apache Spark

Доставка и обмен данными: Kafka, S3

Оркестрация и трансформации: Apache Airflow, Apache NiFi, dbt Core

Аналитические хранилища: ClickHouse

Ad-hoc аналитика: Hue, Jupyter

Каталог данных: DataHub

BI и визуализация: Apache Superset, Grafana

Мониторинг: VictoriaMetrics, Grafana

Инфраструктура: Kubernetes, Docker, Helm

CI/CD: GitLab CI/CD

Мы предлагаем:

  • Официальное оформление в соответствии с ТК РФ в IT-аккредитованную компанию;
  • Совокупный доход: оклад + годовой бонус;
  • График работы: 5/2 (гибридный формат работы);
  • Вакансия открыта для кандидатов, проживающих в РФ, удалённый формат работы из других стран не рассматривается;
  • Техника для работы;
  • Полис ДМС;
  • Программа Best Benefits;
  • Внутреннее обучение;
  • Спортивные и развлекательные мероприятия, участие в корпоративной жизни компании.

Присоединяйтесь к нам и станьте частью истории бренда с историей!

Вакансия опубликована 29 сентября, проверена 01.10.2026. Открыть оригинал.

Как откликнуться

Отклик оформляется на странице работодателя — кнопка выше ведёт туда напрямую. Перед отправкой стоит подогнать резюме под текст вакансии: работодатели читают первые строки и ищут в них свои слова. Если рассылаете отклики десятками, посмотрите сервис автооткликов — он отправляет их за вас по заданным настройкам, до 50 в сутки. Про сам поиск работы есть разбор в статье как быстро найти работу.

Спросите нейросети о вакансии

Отвечает DeepSeek по данным этой страницы: зарплата против рынка, условия, работодатель

Вопросы по этой вакансии

Сколько платят на позиции «Data Engineer (Hadoop / Spark)»?

Вилку работодатель не назвал — обсуждать деньги придётся на собеседовании. Для ориентира: в среднем по направлению «Программист» платят 163 000 ₽.

Какой опыт нужен?

В требованиях указано: от 3 до 6 лет. Формат работы удалённый, переезд не потребуется.

Вакансия ещё открыта?

Да, на 01.10.2026 она активна: каждую ночь каталог сверяется с источником, закрытые предложения помечаются и уходят из списков.

О компании

Детский мир

Группа компаний “ДЕТСКИЙ МИР” - ведущий российский холдинг в сфере продаж товаров детского ассортимента - объединяет национальную сеть магазинов “Детский мир” и розничную сеть «ELC – Центр раннего развития» с товарами для детей до 14 лет. Группа является правообладателем бренда “Детский мир”, одного из старейших в России, имеющего полувековую историю и общенациональную известность. Торговая сеть …

Открытых вакансий: 1065

Похожие вакансии

Соседи по направлению с близкими требованиями.

Ведущий инженер-разработчик автопилота БПЛА

Зарплата не указана

Конструкторское Бюро Атлас · Нижний Новгород

Разработка архитектуры автопилота и системы автоматического управления полётом. Формирование требований к полётному контроллеру, датчикам, исполнительным приводам и интерфейсам летательной платформы.

От 3 до 6 летПрограммистОпубликована 30 сентября

Программист 1С: УТ

Зарплата не указана

Красное & Белое, розничная сеть · Краснодар

Сопровождение, развитие, поддержка системы 1С: УТ. Участие в проекте по внедрению 1С: УТ (нетиповая конфигурация). Контроль, сопровождение использования...

От 3 до 6 летПрограммистОпубликована 30 сентября

Разработчик T-SQL

Зарплата не указана

Maxima.tech · Казань

Разработка и поддержка бизнес-логики на t-sql. Написание сложных запросов (отчетов). Проектирование структуры БД. Оптимизация "чужих" запросов.

От 3 до 6 летПрограммистОпубликована 23 сентября

Старший разработчик С++

Зарплата не указана

Криптонит · Нижний Новгород

Разработка сетевых высоконагруженных приложений на C++. Написание кода по ТЗ в соответствии с имеющейся архитектурой. Участие в разработке ТЗ и...

От 3 до 6 летПрограммистОпубликована 30 сентября

Другие вакансии компании

Специалист склада (специалист по уплотнению)

от 152 200 ₽+62% к среднему

Детский мир · Калуга

Своевременное и качественное пополнение ячеек товаром. Своевременный и качественный пересчет товара, хранящегося на РЦ. Поддерживать порядок в течение рабочей смены.

Нет опытаКладовщикОпубликована 24 сентября

Расчёты по этой вакансии

Пригодится до собеседования: сколько останется на руки от названной суммы, как считаются отпускные и переработки.

Ещё по направлению

Разработка на Python, Java, C#, 1С, JavaScript и других стеках: продукты, интеграции, поддержка систем.