- Страна
- Россия
Senior DevOps Engineer (Monitoring)
Интересный проект в ритейле с четко очерченным стеком технологий мониторинга. Удаленный формат и понятные задачи, однако проект краткосрочный (от 2 месяцев), что может быть минусом для тех, кто ищет стабильность.
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.
Улучшите резюме под эту вакансию
Возьмём требования и создадим новую версию резюме с акцентом на нужный опыт
Сложность вакансии
Роль требует глубокой экспертизы в мониторинге (Prometheus, Grafana, Alertmanager) и навыков разработки на Go для создания кастомных экспортеров. Высокая ответственность за настройку алертинга и мониторинг Kubernetes-кластеров.
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.
Анализ зарплаты
В объявлении не указана заработная плата, но для позиции Senior DevOps в российском ритейле рыночный диапазон составляет от 300 000 до 450 000 рублей в месяц. Учитывая проектный характер работы (от 2 месяцев), ставка может быть выше среднерыночной.
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.
Контакты для отклика
Откройте контакты, указанные в вакансии.
Описание вакансии
ID 3277
DevOps
Senior
Сфера: Ритейл
Кол-во специалистов: 1
Формат: удаленный (c 8:00 до 17:00 или с 9:00 до 18:00 по мск - на выбор)
Продолжительность: от 2 месяцев
*⚙️* Задачи:
• Развертывание и настройка экспортеров (node_exporter, postgres_exporter, blackbox_exporter, cAdvisor, kube-state-metrics)
*❗️**❗️**❗️Писать {{apply_contact}}⚡️**⚡️**⚡️**⚡️ С РЕЗЮМЕ В КОТОРОМ УКАЗАН ВОЗРАСТ И ЛОКАЦИЯ НАХОЖДЕНИЯ. Укажите 🆔*
• Написание сложных PromQL-запросов (histogram_quantile, predict_linear, rate)
• Создание параметризованных дашбордов в Grafana с переменными и аннотациями алертов
• Разработка кастомных HTTP-экспортеров на Go для сбора метрик из очередей сообщений (Kafka/RabbitMQ), планировщиков задач, SCADA/Modbus/OPC UA и SNMP-устройств (принтеры, сканеры) с использованием библиотеки prometheus/client_golang
• Настройка Alertmanager: маршрутизация алертов, inhibition и silences для плановых работ, интеграция с BMC Remedy и мессенджером (webhook)
• Мониторинг Kubernetes (ноды, поды, контейнеры) через kube-state-metrics и cAdvisor
• Настройка алертов на состояния CrashLoopBackOff, OOMKilled, NotReady
• Написание unit-тестов для правил алертинга (promtool test rules) и создание скрипты имитации метрик (Python/Go) для валидации порогов и эскалации
• Конфигурирование таймеров (for), группировки и повторных уведомлений в Alertmanager в соответствии с заданными параметрами
*✅* Требования:
• Готовность в рабочее время при потребности команды оперативно подключается на созвоны
• Готовность оперативно реагировать на сообщения в рабочих чатах
Создайте идеальное резюме с помощью ИИ-агента

Навыки
- Prometheus
- Grafana
- Go
- Kubernetes
- Python
- Alertmanager
- PromQL
- Kafka
- RabbitMQ
- SNMP
- Modbus
- OPC UA
Возможные вопросы на собеседовании
Вакансия предполагает разработку кастомных решений для сбора метрик.
Расскажите о вашем опыте разработки HTTP-экспортеров на Go с использованием prometheus/client_golang. С какими сложностями вы сталкивались?
В задачах указано написание сложных запросов.
Как работает функция histogram_quantile в PromQL и в каких случаях ее использование может давать неточные результаты?
Работа включает глубокую настройку уведомлений.
Объясните разницу между механизмами inhibition и silences в Alertmanager. В каких сценариях вы бы применили каждый из них?
Мониторинг K8s является ключевой частью работы.
Какие метрики из kube-state-metrics вы считаете критическими для отслеживания состояния CrashLoopBackOff и как правильно настроить алерт на это событие?
Упоминается использование promtool.
Как вы организуете процесс тестирования правил алертинга с помощью promtool? Какие кейсы вы обычно покрываете unit-тестами?
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

