Главная›Вакансии›IT и разработка›Дата-сайентист›Ведущий инженер данных (LLM)

ЦРТ | Группа компаний · Москва

Ведущий инженер данных (LLM) — ЦРТ | Группа компаний

Сейчас мы усиливаем усиливаем продуктовую команду и ищем Ведущего инженера данных, который будет отвечать за организацию и подготовку данных для...

Коротко о вакансии

Зарплату работодатель не назвал — вилку обсуждают на собеседовании. В требованиях: sql, etl, алгоритмы и структуры данных, базы данных, python.

Описание вакансии

Мы запустили новый продукт - LLM-платформу для наших клиентов из госсектора и enterprise-сегмента и развиваем его.
Сейчас мы усиливаем усиливаем продуктовую команду и ищем Ведущего инженера данных, который будет отвечать за организацию и подготовку данных для AI-решений (от подключения внешних источников и проектирования модели данных до подготовки данных для поиска и RAG).

КАКИЕ ЗАДАЧИ НЕОБХОДИМО РЕШАТЬ:
  • Определять источники данных для AI-решений: базы данных, документы, API, файловые хранилища, внешние системы и потоки обновлений
  • Проектировать модели данных: сущности и связи, версии, метаданные, lineage, права доступа и правила актуализации
  • Организовывать сбор и обработку данных из внешних источников: очистку, нормализацию, дедупликацию, классификацию и разметку
  • Формировать единое эталонное представление объекта (golden record) при объединении данных из нескольких источников
  • Подготавливать данные для поиска и RAG: chunking, embeddings, индексация, векторный и гибридный поиск
  • Настраивать retrieval и reranking, обеспечивать обновление индексов при изменении исходных данных
  • При необходимости готовить датасеты для обучения или дообучения моделей, если задача не решается с помощью RAG
  • Определять показатели качества данных и retrieval, организовывать их мониторинг: полнота, актуальность, precision/recall, latency и другие показатели
  • Взаимодействовать с LLM-инженерами, аналитиками и разработчиками при проектировании AI-решений


НАШИ ОЖИДАНИЯ:

  • От 4 лет опыта в Data Engineering, Data Platform, Data Architecture или смежной области
  • Уверенное знание SQL и реляционных баз данных
  • Опыт построения ETL/ELT-процессов и data pipelines
  • Опыт интеграции данных из различных источников: БД, API, файлов и внешних систем
  • Практический опыт проектирования моделей данных и работы с качеством данных, метаданными и версиями
  • Опыт работы с большими объёмами данных
  • Практический опыт подготовки данных для поиска, ML или LLM/RAG-систем
  • Понимание принципов chunking, embeddings, vector search и hybrid search
  • Опыт работы с векторными хранилищами или поисковыми системами
  • Умение самостоятельно разбираться в структуре и качестве новых источников данных

БУДЕТ ПЛЮСОМ:

  • Опыт разработки и эксплуатации RAG-систем в production
  • Опыт оптимизации retrieval и reranking
  • Python для обработки данных и разработки data pipelines
  • Kafka или другие системы потоковой обработки данных
  • Airflow или аналогичные инструменты оркестрации
  • PostgreSQL, ClickHouse, Elasticsearch/OpenSearch, векторные хранилища и аналогичные технологии
  • Опыт подготовки датасетов для supervised learning / fine-tuning
  • Понимание метрик оценки RAG: retrieval quality, groundedness, faithfulness, coverage
    ​​​​​​​

Вакансия опубликована 2 октября, проверена 06.10.2026. Открыть оригинал.

Ключевые навыки

SQLETLАлгоритмы и структуры данныхБазы данныхPythonRAGPostgreSQLAPIРабота с большим объемом информацииData Platform

Как откликнуться

Отклик оформляется на странице работодателя — кнопка выше ведёт туда напрямую. Перед отправкой стоит подогнать резюме под текст вакансии: работодатели читают первые строки и ищут в них свои слова. Если рассылаете отклики десятками, посмотрите сервис автооткликов — он отправляет их за вас по заданным настройкам, до 50 в сутки. Про сам поиск работы есть разбор в статье как быстро найти работу.

Спросите нейросети о вакансии

Отвечает DeepSeek по данным этой страницы: зарплата против рынка, условия, работодатель

Вопросы по этой вакансии

Сколько платят на позиции «Ведущий инженер данных (LLM)»?

Вилку работодатель не назвал — обсуждать деньги придётся на собеседовании. Для ориентира: в среднем по направлению «Дата-сайентист» платят 160 000 ₽.

Какой опыт нужен?

В требованиях указано: от 3 до 6 лет. Работать нужно на месте, город — Москва.

Вакансия ещё открыта?

Да, на 06.10.2026 она активна: каждую ночь каталог сверяется с источником, закрытые предложения помечаются и уходят из списков.

О компании

ЦРТ | Группа компаний

Группа компаний ЦРТ — разработчик продуктов и решений на основе разговорного искусственного интеллекта, машинного обучения и компьютерного зрения c 35-летним опытом. Технологический эксперт в области речевых технологий, генеративного искусственного интеллекта, лицевой и голосовой биометрии. Группа ЦРТ реализовала более 5 тыс. ИИ-проектов по всему миру, в том числе — национального масштаба — в Мек…

Похожие вакансии

Соседи по направлению с близкими требованиями.

Data Engineer

Зарплата не указана

ГКУ Инфогород · Москва

Разработка, поддержка и развитие аналитических систем хранения данных. Разработка, поддержка ETL процессов сбора и обработки данных. Создание и развитие системы...

От 3 до 6 летДата-сайентистОпубликована 17 сентября

Data Scientist

Зарплата не указана

Азиатско-Тихоокеанский Банк · Москва

Разрабатывать и внедрять ML-модели для прогнозирования поведения клиентов-физических лиц и розничного продуктового портфеля Банка. Рассчитывать ожидаемые денежные потоки...

От 3 до 6 летДата-сайентистОпубликована 1 октября

Senior NLP Enginee

Зарплата не указана

МТС · Москва

Разрабатывать NLP-компоненты для автоматизации службы клиентской поддержки: классификацию, извлечение сущностей, поиск, RAG и агентские сценарии. Дообучать и адаптировать ML...

От 3 до 6 летДата-сайентистОпубликована 24 сентября

Data Engineer

Зарплата не указана

Datanomica · Москва

Репликация данных. Внедрение моделей. Построение витрин данных. Пакетное распространение данных.

От 3 до 6 летПроектДата-сайентистОпубликована 1 октября

Data Scientist (Риски беззалогового кредитования)

Зарплата не указана

СБЕР · Москва

Построение моделей для управления розничным кредитным риском (PD, Expected Loss, прогнозирование событий жизненного цикла клиента). Поддержание и изменение процессов калибровки...

От 3 до 6 летДата-сайентистОпубликована 1 октября

Middle+ AI Engineer (Native Omnimodality & VLA)

до 500 000 ₽

СБЕР · Москва

Разработка принципиально новых мультимодальных представлений и кодирования информации (vision, audio, video, text). Создание универсальных энкодеров и shared latent spaces.

От 3 до 6 летДата-сайентистОпубликована 1 октября

Другие вакансии компании

Senior AQA, QA Automation Engineer (Java)

Зарплата не указана

ЦРТ | Группа компаний · Санкт-Петербург

Создать проект автотестов с нуля: определить основные сценарии, выбрать структуру проекта, организовать код, конфигурации и тестовые данные. Автоматизировать проверки API...

Более 6 летТестировщикОпубликована 5 октября

Технический писатель (ГОСТ 19, 34)

Зарплата не указана

ЦРТ | Группа компаний · Москва

Разрабатывать и оформлять техническую документацию (проектная, эксплуатационная, пользовательская, административная) с соблюдением корпоративных стандартов и требований ГОСТ (19, 34).

Можно удалённоОт 3 до 6 летТехнический писательОпубликована 29 сентября

Расчёты по этой вакансии

Пригодится до собеседования: сколько останется на руки от названной суммы, как считаются отпускные и переработки.

Ещё по направлению

Модели машинного обучения, прогнозы и рекомендации: Python, статистика, продакшен.