- Страна
- ОАЭ
- Зарплата
- 5 500 $ – 8 200 $
Откликайтесь
на вакансии с ИИ

Infrastructure Engineer
Привлекательное предложение с высокой зарплатой (особенно после релокации) и возможностью работать с передовыми AI-технологиями. Однако необходимость обязательного переезда в Абу-Даби и работа с bare metal могут подойти не всем.
Сложность вакансии
Высокая сложность обусловлена требованием глубоких знаний bare metal инфраструктуры, сетей L2/L3 и внутреннего устройства Kubernetes без использования облаков. Также критичны готовность к релокации в ОАЭ и участие в on-call дежурствах.
Анализ зарплаты
Предлагаемая зарплата в $8,000–8,200 после релокации находится на верхней границе рынка для Senior Infrastructure ролей в ОАЭ. Удаленная ставка в $5,500–6,000 также соответствует международным стандартам для опытных инженеров.
Сопроводительное письмо
Составьте идеальное письмо к вакансии с ИИ-агентом

Откликнитесь в Aleria LLC уже сейчас
Если вы готовы к релокации в Абу-Даби и глубокой работе с bare metal инфраструктурой, откликайтесь прямо сейчас!
Описание вакансии
Публикатор: Andrey
Обсуждение: @devops_jobs
Ищу Infrastructure Engineer себе в команду.
Формат: удаленно(2 месяца испытательного), обязателен релок после 2 месяцев в Абу Даби
Занятость: full-time
Локация: Абу Даби
Вилка: 5500-6.000$ remote, 8.000-8200$ onsite
Компания: Aleria LLC
Контакт: Откликнуться
Infrastructure Engineer
Aleria — компания из Абу-Даби, разрабатывающая AI-продукты для клиентов в ОАЭ и по всему миру. Небольшая команда, быстрый рост. Работаем на bare metal, без облака. Нужен инженер, который понимает каждый слой — от NIC до Kubernetes pod — и отвечает за то, чтобы всё это работало стабильно под нагрузкой и не падало посреди ночи.
Чем предстоит заниматься:
Обеспечивать надёжность и доступность сервисов на bare metal с Kubernetes поверх железа
Строить и поддерживать observability (Prometheus, Grafana, Loki): метрики, дашборды, алерты, SLO/SLI
Реагировать на инциденты, проводить post-mortem и устранять причины, а не симптомы
Тюнить PostgreSQL и другие БД под продакшен-нагрузку, искать боттлнеки
Поддерживать CI/CD (GHES, ArgoCD), снижать время и риск деплоев
Сетевая инфраструктура: маршрутизация, сегментация, балансировка нагрузки, безопасность
On-premise и air-gapped поставки (~10%)
Capacity planning и работа над снижением toil
Безопасность, которая не тормозит команду
Взаимодействие с командой разработки и инженерами клиентов
Требования:
Глубокий опыт bare metal — без облачных абстракций
Понимание внутреннего устройства Kubernetes, а не только манифестов
Опыт устранения продакшен-инцидентов под давлением, умение быстро находить root cause
Тюнинг БД под нагрузкой (приоритет — PostgreSQL)
Опыт построения observability и систем алертинга с нуля
Опыт on-prem и air-gapped развёртываний
Сети: L2/L3, routing, firewall, VPN
Продакшен Linux troubleshooting
Подход security-mindset с балансом на скорость доставки
Высокая автономность при работе с незнакомым стеком
Видение инфраструктуры за пределами текущей задачи
Английский B2+
Будет плюсом:
Опыт с GPU-кластерами для AI
Ceph/ZFS/распределённые хранилища
Опыт hardening/compliance для гос. заказчиков
Air-gap CI/CD
Не ищем:
YAML-инженеров, которые только применяют готовые манифесты. Нужен человек, который понимает, что происходит под капотом — и готов первым встать ночью, если что-то упало.
Создайте идеальное резюме с помощью ИИ-агента

Навыки
- Kubernetes
- Prometheus
- Grafana
- CI/CD
- PostgreSQL
- Networking
- ArgoCD
- Ceph
- ZFS
- GPU
- Loki
- Bare Metal
- L2/L3
- Linux Troubleshooting
Возможные вопросы на собеседовании
Проверка понимания работы K8s без облачных провайдеров.
Расскажите, как вы организуете балансировку внешнего трафика (LoadBalancer) и управление хранилищами (PV/PVC) в Kubernetes на bare metal?
Оценка навыков траблшутинга БД.
С какими специфическими проблемами производительности PostgreSQL вы сталкивались под высокой нагрузкой и какие параметры ядра Linux или конфига БД вы тюнили для их решения?
Проверка сетевой экспертизы.
Опишите процесс отладки сетевой связности между подами в разных сегментах сети, если стандартные средства диагностики показывают, что пакеты теряются на уровне L3.
Опыт работы в изолированных средах.
В чем заключаются основные сложности организации CI/CD и обновления образов в air-gapped окружениях, и как вы их решали?
Оценка стрессоустойчивости и ответственности.