yandex
N
NDA
Страна
Россия
SeniorУдалённоКонтракт

Senior DevOps Engineer (Monitoring)

ИИОценка ИИ

Интересный проект в ритейле с четко очерченным стеком технологий мониторинга. Удаленный формат и понятные задачи, однако проект краткосрочный (от 2 месяцев), что может быть минусом для тех, кто ищет стабильность.

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.


Вакансия из открытого источника
Пожаловаться
+400% приглашений от HR

Улучшите резюме под эту вакансию

Возьмём требования и создадим новую версию резюме с акцентом на нужный опыт

Сложность вакансии

ЛегкоСложно
ИИОценка ИИ

Роль требует глубокой экспертизы в мониторинге (Prometheus, Grafana, Alertmanager) и навыков разработки на Go для создания кастомных экспортеров. Высокая ответственность за настройку алертинга и мониторинг Kubernetes-кластеров.

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

Анализ зарплаты

Медиана380 000 ₽
Рынок300 000 ₽ – 450 000 ₽
ИИОценка ИИ

В объявлении не указана заработная плата, но для позиции Senior DevOps в российском ритейле рыночный диапазон составляет от 300 000 до 450 000 рублей в месяц. Учитывая проектный характер работы (от 2 месяцев), ставка может быть выше среднерыночной.

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

Сопроводительное письмо

Составьте сопроводительное письмо под эту вакансию с вашим резюме

Иллюстрация сопроводительного письмаИллюстрация сопроводительного письма

Контакты для отклика

Откройте контакты, указанные в вакансии.

Описание вакансии

ID 3277

DevOps

Senior

Сфера: Ритейл

Кол-во специалистов: 1

Формат: удаленный (c 8:00 до 17:00 или с 9:00 до 18:00 по мск - на выбор)

Продолжительность: от 2 месяцев

*⚙️* Задачи:

• Развертывание и настройка экспортеров (node_exporter, postgres_exporter, blackbox_exporter, cAdvisor, kube-state-metrics)

*❗️**❗️**❗️Писать {{apply_contact}}⚡️**⚡️**⚡️**⚡️ С РЕЗЮМЕ В КОТОРОМ УКАЗАН ВОЗРАСТ И ЛОКАЦИЯ НАХОЖДЕНИЯ. Укажите 🆔*

• Написание сложных PromQL-запросов (histogram_quantile, predict_linear, rate)

• Создание параметризованных дашбордов в Grafana с переменными и аннотациями алертов

• Разработка кастомных HTTP-экспортеров на Go для сбора метрик из очередей сообщений (Kafka/RabbitMQ), планировщиков задач, SCADA/Modbus/OPC UA и SNMP-устройств (принтеры, сканеры) с использованием библиотеки prometheus/client_golang

• Настройка Alertmanager: маршрутизация алертов, inhibition и silences для плановых работ, интеграция с BMC Remedy и мессенджером (webhook)

• Мониторинг Kubernetes (ноды, поды, контейнеры) через kube-state-metrics и cAdvisor

• Настройка алертов на состояния CrashLoopBackOff, OOMKilled, NotReady

• Написание unit-тестов для правил алертинга (promtool test rules) и создание скрипты имитации метрик (Python/Go) для валидации порогов и эскалации

• Конфигурирование таймеров (for), группировки и повторных уведомлений в Alertmanager в соответствии с заданными параметрами

*✅* Требования:

• Готовность в рабочее время при потребности команды оперативно подключается на созвоны

• Готовность оперативно реагировать на сообщения в рабочих чатах

+400% к собеседованиям

Создайте идеальное резюме с помощью ИИ-агента

Создайте идеальное резюме с помощью ИИ-агента

Навыки

  • Prometheus
  • Grafana
  • Go
  • Kubernetes
  • Python
  • Alertmanager
  • PromQL
  • Kafka
  • RabbitMQ
  • SNMP
  • Modbus
  • OPC UA

Возможные вопросы на собеседовании

Вакансия предполагает разработку кастомных решений для сбора метрик.

Расскажите о вашем опыте разработки HTTP-экспортеров на Go с использованием prometheus/client_golang. С какими сложностями вы сталкивались?

В задачах указано написание сложных запросов.

Как работает функция histogram_quantile в PromQL и в каких случаях ее использование может давать неточные результаты?

Работа включает глубокую настройку уведомлений.

Объясните разницу между механизмами inhibition и silences в Alertmanager. В каких сценариях вы бы применили каждый из них?

Мониторинг K8s является ключевой частью работы.

Какие метрики из kube-state-metrics вы считаете критическими для отслеживания состояния CrashLoopBackOff и как правильно настроить алерт на это событие?

Упоминается использование promtool.

Как вы организуете процесс тестирования правил алертинга с помощью promtool? Какие кейсы вы обычно покрываете unit-тестами?

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

Похожие вакансии

N
NDA
Россия
более 1000 офферов получено
4.9

1000+ офферов получено

Устали искать работу? Мы найдём её за вас

Quick Offer улучшит ваше резюме, подберёт лучшие вакансии и откликнется за вас. Результат — в 3 раза больше приглашений на собеседования и никакой рутины!