Откликайтесь
на вакансии с ИИ

Инженер OpenStack / DevOps (L3 Support & Infrastructure)
Очень сильная техническая роль с широким стеком современных технологий (K8s, OpenStack, Ceph, IaC). Вакансия предлагает работу с высоконагруженными системами и сложными архитектурными задачами, что отлично подходит для профессионального роста Senior-специалиста.
Сложность вакансии
Вакансия требует исключительной экспертизы в OpenStack на уровне архитектора и системного инженера, включая глубокое понимание сетей, хранилищ Ceph и контейнеризации в K8s. Необходимость поддержки 24/7 и проведения Chaos Engineering тестов значительно повышает уровень ответственности.
Анализ зарплаты
Учитывая экстремально высокие требования к знанию OpenStack, Ceph и Kubernetes, рыночная зарплата для таких специалистов в России находится в верхнем сегменте IT-рынка. Вакансия предполагает уровень Senior/Lead, где компенсация значительно выше средней по рынку DevOps.
Сопроводительное письмо
Составьте идеальное письмо к вакансии с ИИ-агентом

Откликнитесь уже сейчас
Если вы эксперт в OpenStack и Kubernetes, готовый к сложным вызовам в высоконагруженной среде — откликайтесь прямо сейчас!
Описание вакансии
CI/CD и контейнеризация:
- Опыт проектирования и внедрения CI/CD pipelines;
- Уверенное знание Docker и Kubernetes: опыт эксплуатации k8s-кластеров, понимание CNI, CSI, operators;
- Опыт интеграции OpenStack Magnum или развёртывания k8s поверх OpenStack.
Задачи на проекте
Эксплуатация и поддержка кластера:
- Поддержка production-кластера OpenStack в режиме 24/7: мониторинг, реакция на алерты, разбор инцидентов;
- Диагностика и устранение сбоев на всех уровнях: вычислительные узлы (Nova), сети (Neutron), хранилища (Cinder/Ceph), аутентификация (Keystone), образы (Glance);
- Восстановление сервисов после падений: перезапуск агентов, failover контроллеров, восстановление БД;
- Анализ логов всех компонентов OpenStack и связанной инфраструктуры для выявления root cause;
- Написание и актуализация runbooks - пошаговых инструкций для команды поддержки по типовым и аварийным сценариям.
Производительность и оптимизация:
- Тюнинг производительности OpenStack: оптимизация расписания Nova (scheduler filters, weights), настройка NUMA, CPU pinning, hugepages для ВМ;
- Оптимизация сетевого стека: настройка OVS/OVN, VXLAN offloading, DPDK, SR-IOV для снижения latency;
- Оптимизация хранилищ: тюнинг Ceph (CRUSH map, pg_num, osd_memory_target), настройка multi-backend Cinder, выбор правильного типа томов (SSD/HDD/NVMe);
- Capacity planning: прогнозирование роста ресурсов, анализ трендов потребления CPU/RAM/Storage/Network.
Развёртывание и миграция:
- Развёртывание кластера OpenStack с нуля: проектирование архитектуры, установка, настройка всех сервисов (vanilla или через дистрибутив - Charmed, RHOSP, Mirantis);
- Апгрейд/обновление существующего кластера между версиями OpenStack (например, Yoga → Zed → Antelope) с минимальным downtime;
- Миграция виртуальных машин и данных с VMware vSphere/ Hyper-V/других платформ на OpenStack;
- Расширение кластера: добавление новых вычислительных узлов, контроллеров, хранилищ без прерывания работы сервисов.
Сети и безопасность:
- Проектирование и настройка сетевой топологии в Neutron: tenant networks, provider networks, VLAN/VXLAN, floating IPs, security groups;
- Настройка и отладка L3-агентов, DHCP-агентов, metadata-агентов, LBaaS (Octavia);
- Настройка firewall'ов и сетевой сегментации между проектами/тенантами;
- Интеграция с внешними сетями: BGP, EVPN, физические коммутаторы, аплинки;
- Диагностика сложных сетевых проблем: потеря пакетов, asymmetric routing, ARP-флуд, MTU mismatch, conntrack overflow.
Хранилища и резервное копирование:
- Эксплуатация Ceph-кластера: мониторинг здоровья, rebalance, замена вышедших из строя дисков/узлов, масштабирование;
- Управление блочными томами Cinder: создание типов томов, multi-backend, QoS, encryption;
- Настройка резервного копирования ВМ и томов (например, через Cinder backup, Ceph snapshots, или сторонние инструменты);
- Восстановление данных из бэкапов: откат ВМ, восстановление томов, восстановление БД OpenStack.
Автоматизация и инфраструктура как код:
- Написание Ansible-плейбуков для автоматизации рутинных операций: развёртывание узлов, обновление конфигураций, массовые изменения;
- Управление инфраструктурой через Terraform: создание проектов, сетей, ВМ, балансировщиков как код;
- Автоматизация CI/CD для инфраструктурных изменений: pipeline'ы для тестирования и деплоя конфигураций;
- Разработка скриптов (Python/Bash) для интеграции с API OpenStack, автоматизации биллинга, отчётности.
Мониторинг и observability:
- Построение и поддержка системы мониторинга: Prometheus + Grafana/Zabbix — настройка экспортёров, создание дашбордов, настройка алертов;
- Централизованное логирование: настройка сбора логов со всех компонентов OpenStack в ELK/EFK/Loki;
- Настройка алертинга: определение пороговых значений, настройка escalation, интеграция с PagerDuty/OpsGenie/Slack;
- Проведение анализа инцидентов: корреляция метрик, логов и трейсов для определения root cause;
- Chaos Engineering: планирование и проведение тестов отказоустойчивости (отключение узлов, сетевых линков, дисков).
Создайте идеальное резюме с помощью ИИ-агента

Навыки
- Python
- Terraform
- Kubernetes
- Bash
- Prometheus
- Grafana
- CI/CD
- Docker
- Ansible
- BGP
- ELK
- OpenStack
- Ceph
- Loki
- EVPN
- DPDK
- OVS
- OVN
- SR-IOV
- OpenStack Magnum
- Neutron
- Nova
- Cinder
- Keystone
- Glance
Возможные вопросы на собеседовании
Проверка понимания сетевой архитектуры OpenStack и умения решать критические проблемы связности.
Опишите ваш алгоритм диагностики при возникновении MTU mismatch в связке VXLAN и физической сети. Как вы будете искать место потери пакетов?
Оценка навыков работы с распределенными хранилищами, которые являются критическим узлом.
С какими проблемами производительности Ceph вы сталкивались и какие параметры CRUSH map или настройки OSD помогали их решить?
Проверка опыта проведения сложных обновлений платформы без прерывания сервиса.
Расскажите о вашем опыте апгрейда OpenStack (например, с Yoga на Zed). С какими основными рисками вы столкнулись и как обеспечили минимальный downtime?
Оценка навыков оптимизации для высоконагруженных систем.
В каких случаях вы бы рекомендовали использовать CPU pinning и Hugepages, и какие побочные эффекты это может вызвать для планировщика Nova?
Проверка умения работать с Kubernetes в контексте OpenStack.
Каковы особенности эксплуатации Kubernetes-кластеров, развернутых через OpenStack Magnum, по сравнению с bare-metal инсталляциями?
Похожие вакансии
Senior / Lead DevOps (Platform / SRE)
Devops-инженер
Senior DevOps
DevOps (Middle+)
DevOps Engineer (Data Platform & OT Integration)
DevOps Middle, Middle+, Senior
1000+ офферов получено
Устали искать работу? Мы найдём её за вас
Quick Offer улучшит ваше резюме, подберёт лучшие вакансии и откликнется за вас. Результат — в 3 раза больше приглашений на собеседования и никакой рутины!