Главная›Вакансии›IT и разработка›DevOps-инженер›Linux-инженер (сопровождение on-premise AI-платформы)

Группа IT-компаний Lad · Нижний Новгород

Linux-инженер (сопровождение on-premise AI-платформы) — Группа IT-компаний Lad

Анализировать логи и метрики заказчиков: системные логи, логи сервисов, дашборды Grafana, метрики Prometheus. Обновлять компоненты по инструкциям от команды разработки...

Опубликована сегодня

Коротко о вакансии

Зарплату работодатель не назвал — вилку обсуждают на собеседовании. В требованиях: linux, kubernetes, bash, prometheus, grafana. Компания нанимает активно — открытых позиций сейчас 8.

Описание вакансии

Мы — группа IT-компаний Lad: 34 года помогаем бизнесу автоматизировать процессы и внедрять новые технологии, более 500 специалистов в команде. В 2025 году вошли в ТОП-100 работодателей России и заняли 1 место среди IT-компаний Нижегородской области.

Ladcraft — платформа автономных ИИ-агентов для бизнеса. Разворачивается на серверах заказчика в изолированной сети, без доступа в интернет, и работает в Kubernetes; часть инсталляций использует локальный инференс моделей на GPU. Ваша задача — обеспечивать стабильную работу этой инфраструктуры.

Чем предстоит заниматься:
  • Анализировать логи и метрики заказчиков: системные логи, логи сервисов, дашборды Grafana, метрики Prometheus.
  • Обновлять компоненты по инструкциям от команды разработки: пакеты, сервисы, бандлы.
  • Готовить хосты к установке: базовая настройка ОС (Альт Сервер 10.4 / Debian / Ubuntu / Astra SE 1.7, 1.8), проверка ресурсов, сети и файловых систем.
  • Настраивать и диагностировать GPU: доступность видеокарт, драйверы, распределение видеопамяти между LLM-моделями, контроль температур и загрузки.
  • Разбирать инциденты в Kubernetes: падающие поды, нехватка ресурсов, OOMKill, CrashLoopBackOff, проблемы с Ingress, ConfigMaps, Secrets, PVC.
  • Локализовать лёгкие и средние инциденты, применять типовые решения и эскалировать с полным контекстом: логи, метрики, шаги, гипотезы.
  • Взаимодействовать с DevOps и разработкой, готовить репродукции проблем.
  • Общаться с заказчиком в чатах и по почте: собирать данные по инциденту, согласовывать окна обновлений, отчитываться о результатах.
  • Развертывать платформу в закрытых контурах.
  • Первоначальная настройка контура.
Что мы ожидаем:
  • Linux на уровне уверенного пользователя: процессы и нагрузка, службы, файловые системы и сетевые соединения.
  • Уверенное владение Kubernetes: архитектура кластера, работа с kubectl, диагностика подов, понимание Ingress, Services, ConfigMaps, Secrets, PVC/StorageClass, ResourceQuota, HPA. Умение читать манифесты и понимать, что в них не так.
  • Понимание сетей: TCP/UDP, DNS, MTU, базовая диагностика.
  • Опыт работы с мониторингом: Prometheus, Grafana, Loki — чтение дашбордов, поиск аномалий.
  • Понимание HTTP-кодов ошибок (502, 504) и их причин в инфраструктуре с прокси и балансировщиком.
  • Базовый bash для простых скриптов диагностики.
  • Понимание принципов systemd: unit-файлы, зависимости, статусы служб.
  • Понимание работы локального инференса: видеопамять и требования моделей, диагностика нехватки видеопамяти, знакомство с утилитами мониторинга GPU.
  • Умение самостоятельно выстраивать план диагностики: ОС → Kubernetes → приложение → сеть.
  • Коммуникационные навыки: чётко формулировать вопросы, собирать нужные данные и объяснять статус и дальнейшие шаги инженерам и руководителям проектов заказчика.
  • Готовность вовремя признавать незнание и эскалировать, спокойствие в инцидентах: сначала факты, потом действия.
Мы предлагаем:
  • Официальное трудоустройство, полная занятость.
  • Удалённый формат работы, в Нижнем Новгороде возможен гибрид.
  • Гибкое начало рабочего дня (9:00–11:00 по МСК).
  • Команда разработки и DevOps рядом: помогают, но ожидают самостоятельности в своей зоне.
  • Обучение и развитие: Lad Универ, внешние тренинги и митапы, выстроенный онбординг, индивидуальный план развития.
  • ДМС, чекапы, компенсация спорта.
  • Оплачиваемый выходной в день рождения, магазин мерча.

Вакансия опубликована 1 октября, проверена 02.10.2026. Открыть оригинал.

Ключевые навыки

LinuxKubernetesBashPrometheusGrafanaLokisystemdTCP/IPDNSGPULLM

Как откликнуться

Отклик оформляется на странице работодателя — кнопка выше ведёт туда напрямую. Перед отправкой стоит подогнать резюме под текст вакансии: работодатели читают первые строки и ищут в них свои слова. Если рассылаете отклики десятками, посмотрите сервис автооткликов — он отправляет их за вас по заданным настройкам, до 50 в сутки. Про сам поиск работы есть разбор в статье как быстро найти работу.

Спросите нейросети о вакансии

Отвечает DeepSeek по данным этой страницы: зарплата против рынка, условия, работодатель

Вопросы по этой вакансии

Сколько платят на позиции «Linux-инженер (сопровождение on-premise AI-платформы)»?

Вилку работодатель не назвал — обсуждать деньги придётся на собеседовании. Для ориентира: в среднем по направлению «DevOps-инженер» платят 175 000 ₽.

Какой опыт нужен?

В требованиях указано: от 3 до 6 лет. Формат работы удалённый, переезд не потребуется.

Вакансия ещё открыта?

Да, на 02.10.2026 она активна: каждую ночь каталог сверяется с источником, закрытые предложения помечаются и уходят из списков.

О компании

Группа IT-компаний Lad

Группа IT-компаний Lad объединяет IT-компании, занимающиеся собственной продуктовой разработкой, дистрибуцией и системной интеграцией российских IT-решений. Решаем задачи по автоматизации бизнеса с помощью современных технологий. Развиваем два собственных продукта на базе AI. У нас ты можешь реализовать свой потенциал как начинающий или уже опытный специалист. Мы работаем на рынке РФ 34 года. На…

Открытых вакансий: 8

Похожие вакансии

Соседи по направлению с близкими требованиями.

Senior DevOps Engineer

Зарплата не указана

ВАЙБ ГЕЙМС · Москва

Зона ответственности. - Развивать и поддерживать продакшен-инфраструктуру, повышать ее отказоустойчивость и доступность. - Находить и устранять системные причины инфраструктурных сбоев, снижать...

Можно удалённоОт 3 до 6 летDevOps-инженерОпубликована 29 сентября

DevOps-инженер

Зарплата не указана

Облачные решения · Пенза

Поддерживать и расширять кластера, работающие на Kubernetes / Deckhouse. CI/CD: разработка и поддержка пайплайнов в GitLab CI, оптимизация процессов доставки...

Более 6 летDevOps-инженерОпубликована 1 октября

Senior Infrastructure Engineer / Senior DevOps / Platform Engineer

Зарплата не указана

Системы документооборота · Казань

Проектировать и развивать инфраструктуру на базе Linux и Kubernetes. Участвовать в архитектуре Kubernetes-кластеров и платформенных сервисов. Развивать подход Platform...

Более 6 летDevOps-инженерОпубликована 1 октября

Web SRE/Site Reliability Engineer

Зарплата не указана

DDoS-Guard · Ростов-на-Дону

Проектированием и поддержкой инфраструктуры сервисов: созданием отказоустойчивой среды для работы веб-сервисов (монолита, лендингов, статических страниц). Администрированием и тюнингом баз...

От 3 до 6 летDevOps-инженерОпубликована 1 октября

DevOps Team Lead / Head of DevOps

Зарплата не указана

SWOYO · Нижний Новгород

SaaS + On-prem поставки. Собственные bare-metal серверы в дата-центрах. VMware. Docker / Docker Swarm с переходом на Kubernetes.

Более 6 летDevOps-инженерОпубликована 1 октября

DevOps-инженер

Зарплата не указана

Koronatech · Новосибирск

Поддержка и развитие систем автоматизированной сборки и доставки приложений. Построение и сопровождение процессов CI/CD. Обеспечение доставки изменений на тестовые...

Можно удалённоОт 3 до 6 летDevOps-инженерОпубликована 1 октября

Другие вакансии компании

Менеджер по работе с партнерами (AI)

от 110 000 ₽-17% к среднему

Группа IT-компаний Lad · Нижний Новгород

Искать, привлекать и онбордить новых партнеров. Выполнять план продаж через партнерский канал. Поддерживать партнеров на сделках: совместно ходить к заказчикам...

Можно удалённоОт 1 года до 3 летМенеджер по работе с партнёрамиОпубликована 22 сентября

Расчёты по этой вакансии

Пригодится до собеседования: сколько останется на руки от названной суммы, как считаются отпускные и переработки.

Ещё по направлению

CI/CD, контейнеры, облака и мониторинг: доставка кода и стабильность сервисов.