Откликайтесь
на вакансии с ИИ

Инженер OpenStack / DevOps (Cloud Infrastructure)
Отличная вакансия для системных инженеров и DevOps-специалистов, желающих работать с 'тяжелым' стеком технологий. Огромный спектр задач от архитектуры до Chaos Engineering обеспечивает профессиональный рост.
Сложность вакансии
Вакансия требует экспертных знаний в OpenStack (глубокий тюнинг, апгрейды версий) и Ceph, а также навыков работы с сетями на уровне L3/BGP. Высокая ответственность из-за поддержки 24/7 и задач по миграции критических систем.
Анализ зарплаты
Зарплата в объявлении не указана, но для специалистов такого уровня (OpenStack + Ceph + K8s) рыночные предложения в России обычно начинаются от 300 000 рублей. В международном сегменте компенсация может быть значительно выше.
Сопроводительное письмо
Составьте идеальное письмо к вакансии с ИИ-агентом

Откликнитесь уже сейчас
Если вы готовы взять на себя управление сложной инфраструктурой OpenStack и Ceph, отправляйте свое резюме прямо сейчас!
Описание вакансии
CI/CD и контейнеризация:
- Опыт проектирования и внедрения CI/CD pipelines;
- Уверенное знание Docker и Kubernetes: опыт эксплуатации k8s-кластеров, понимание CNI, CSI, operators;
- Опыт интеграции OpenStack Magnum или развёртывания k8s поверх OpenStack.
Задачи на проекте
Эксплуатация и поддержка кластера:
- Поддержка production-кластера OpenStack в режиме 24/7: мониторинг, реакция на алерты, разбор инцидентов;
- Диагностика и устранение сбоев на всех уровнях: вычислительные узлы (Nova), сети (Neutron), хранилища (Cinder/Ceph), аутентификация (Keystone), образы (Glance);
- Восстановление сервисов после падений: перезапуск агентов, failover контроллеров, восстановление БД;
- Анализ логов всех компонентов OpenStack и связанной инфраструктуры для выявления root cause;
- Написание и актуализация runbooks - пошаговых инструкций для команды поддержки по типовым и аварийным сценариям.
Производительность и оптимизация:
- Тюнинг производительности OpenStack: оптимизация расписания Nova (scheduler filters, weights), настройка NUMA, CPU pinning, hugepages для ВМ;
- Оптимизация сетевого стека: настройка OVS/OVN, VXLAN offloading, DPDK, SR-IOV для снижения latency;
- Оптимизация хранилищ: тюнинг Ceph (CRUSH map, pg_num, osd_memory_target), настройка multi-backend Cinder, выбор правильного типа томов (SSD/HDD/NVMe);
- Capacity planning: прогнозирование роста ресурсов, анализ трендов потребления CPU/RAM/Storage/Network.
Развёртывание и миграция:
- Развёртывание кластера OpenStack с нуля: проектирование архитектуры, установка, настройка всех сервисов (vanilla или через дистрибутив - Charmed, RHOSP, Mirantis);
- Апгрейд/обновление существующего кластера между версиями OpenStack (например, Yoga → Zed → Antelope) с минимальным downtime;
- Миграция виртуальных машин и данных с VMware vSphere/ Hyper-V/других платформ на OpenStack;
- Расширение кластера: добавление новых вычислительных узлов, контроллеров, хранилищ без прерывания работы сервисов.
Сети и безопасность:
- Проектирование и настройка сетевой топологии в Neutron: tenant networks, provider networks, VLAN/VXLAN, floating IPs, security groups;
- Настройка и отладка L3-агентов, DHCP-агентов, metadata-агентов, LBaaS (Octavia);
- Настройка firewall'ов и сетевой сегментации между проектами/тенантами;
- Интеграция с внешними сетями: BGP, EVPN, физические коммутаторы, аплинки;
- Диагностика сложных сетевых проблем: потеря пакетов, asymmetric routing, ARP-флуд, MTU mismatch, conntrack overflow.
Хранилища и резервное копирование:
- Эксплуатация Ceph-кластера: мониторинг здоровья, rebalance, замена вышедших из строя дисков/узлов, масштабирование;
- Управление блочными томами Cinder: создание типов томов, multi-backend, QoS, encryption;
- Настройка резервного копирования ВМ и томов (например, через Cinder backup, Ceph snapshots, или сторонние инструменты);
- Восстановление данных из бэкапов: откат ВМ, восстановление томов, восстановление БД OpenStack.
Автоматизация и инфраструктура как код:
- Написание Ansible-плейбуков для автоматизации рутинных операций: развёртывание узлов, обновление конфигураций, массовые изменения;
- Управление инфраструктурой через Terraform: создание проектов, сетей, ВМ, балансировщиков как код;
- Автоматизация CI/CD для инфраструктурных изменений: pipeline'ы для тестирования и деплоя конфигураций;
- Разработка скриптов (Python/Bash) для интеграции с API OpenStack, автоматизации биллинга, отчётности.
Мониторинг и observability:
- Построение и поддержка системы мониторинга: Prometheus + Grafana/Zabbix — настройка экспортёров, создание дашбордов, настройка алертов;
- Централизованное логирование: настройка сбора логов со всех компонентов OpenStack в ELK/EFK/Loki;
- Настройка алертинга: определение пороговых значений, настройка escalation, интеграция с PagerDuty/OpsGenie/Slack;
- Проведение анализа инцидентов: корреляция метрик, логов и трейсов для определения root cause;
- Chaos Engineering: планирование и проведение тестов отказоустойчивости (отключение узлов, сетевых линков, дисков).
Создайте идеальное резюме с помощью ИИ-агента

Навыки
- Python
- Linux
- Terraform
- Kubernetes
- Bash
- Prometheus
- Grafana
- Docker
- Ansible
- BGP
- ELK
- OpenStack
- Ceph
- Loki
- OVS
- OVN
Возможные вопросы на собеседовании
Проверка понимания архитектуры и умения минимизировать простои при обновлении ядра системы.
Опишите ваш опыт апгрейда OpenStack между мажорными версиями. С какими основными сложностями вы сталкивались и как обеспечивали минимальный downtime?
Важно для высокопроизводительных вычислений и понимания работы гипервизора.
В каких случаях вы бы использовали CPU pinning и Hugepages для виртуальных машин, и как это влияет на планировщик Nova?
Проверка навыков траблшутинга сложных сетевых проблем в виртуализированной среде.
Как вы будете диагностировать проблему MTU mismatch в сети Neutron, если пакеты теряются только при прохождении через определенные сегменты?
Оценка знаний в области хранения данных и умения восстанавливать кластер.
Ваш Ceph-кластер перешел в состояние HEALTH_ERR из-за массового выхода OSD из строя. Каковы ваши первоочередные действия для стабилизации системы?
Проверка навыков автоматизации и работы с API.
Как вы организуете процесс CI/CD для инфраструктурных изменений в Terraform, чтобы избежать конфликтов при одновременной работе нескольких инженеров?
Похожие вакансии
DevOps инженер (middle)
Senior / Lead DevOps (Platform / SRE)
Devops-инженер
Senior DevOps
DevOps (Middle+)
DevOps Engineer (Data Platform & OT Integration)
1000+ офферов получено
Устали искать работу? Мы найдём её за вас
Quick Offer улучшит ваше резюме, подберёт лучшие вакансии и откликнется за вас. Результат — в 3 раза больше приглашений на собеседования и никакой рутины!