- Страна
- США
Откликайтесь
на вакансии с ИИ

Staff Site Reliability Engineer
Высокий балл за социально значимый продукт, работу с современным стеком (AI/ML, AWS, K8s) и возможность влиять на стратегию компании. Удаленный формат с поездками в Нью-Йорк добавляет привлекательности для опытных специалистов.
Сложность вакансии
Роль уровня Staff предполагает не только глубокие технические знания AWS, K8s и Terraform, но и стратегическое мышление для проектирования SLO и стандартов автоматизации в масштабах всей компании. Высокий порог входа обусловлен требованием 7+ лет опыта и необходимостью выстраивать процессы с нуля.
Анализ зарплаты
Для позиции уровня Staff SRE в американской компании (даже при удаленной работе из других регионов) рыночная вилка обычно составляет $180,000–$250,000 в год без учета опционов. Данная роль предполагает высокую ответственность, что соответствует верхним границам рынка.
Сопроводительное письмо
Составьте идеальное письмо к вакансии с ИИ-агентом

Откликнитесь в Garner Health уже сейчас
Присоединяйтесь к Garner Health, чтобы строить надежную инфраструктуру для платформы, спасающей жизни и экономящей миллиарды на здравоохранении!
Описание вакансии
Откликнуться в Garner Health
*🤩* Удалённо
*🔔* Опубликовано менее 24 часов назад
*📸 Платформа для выбора высокоэффективных врачей на основе клинических данных*
*🤩* Помогла более 2,5 млн человек получить более качественную медицинскую помощь
*🤩* Сэкономила $1 млрд на расходах на здравоохранение за пять лет работы
Задачи:
• Формирование стратегии надёжности cloud-инфраструктуры для продуктов и AI/ML-нагрузок;
• Проектирование SLO, incident response и стандартов автоматизации для всех инженерных команд;
• Развитие observability-платформы: мониторинг, алертинг и раннее обнаружение проблем;
• Удалённая работа с периодическими поездками в штаб-квартиру в Нью-Йорке.
*🕸 Требования:*
• 7+ лет эксплуатации production cloud-инфраструктуры в SRE, DevOps или Platform Engineering;
• Глубокие знания Kubernetes и Terraform, предпочтительно в AWS;
• Опыт построения SLO, observability и incident response практик;
• Python или Go для автоматизации инфраструктуры.
Откликнуться: Откликнуться
*🚀* Offer Inside
#devops #staff #engineer
Создайте идеальное резюме с помощью ИИ-агента

Навыки
- AWS
- Python
- Terraform
- Kubernetes
- SRE
- DevOps
- Incident Response
- Observability
- SLO
- Go
- Platform Engineering
Возможные вопросы на собеседовании
Вопрос проверяет умение кандидата мыслить стратегически и внедрять культуру надежности в инженерные команды.
Как бы вы подошли к определению и внедрению SLO для новой AI/ML-нагрузки в Garner Health?
Важно понять, как кандидат балансирует между скоростью разработки и стабильностью системы.
Опишите ваш опыт проектирования систем Incident Response. Как вы автоматизируете процесс обнаружения и устранения сбоев?
Проверка технических навыков работы с инфраструктурным кодом в сложных средах.
С какими наиболее сложными проблемами масштабирования Kubernetes в AWS вы сталкивались и как их решали?
Оценка навыков автоматизации и выбора инструментов.
В каких случаях для автоматизации инфраструктуры вы выберете Go вместо Python, и наоборот? Приведите примеры из практики.
Проверка понимания Observability как целостной системы, а не просто набора дашбордов.
Как вы строите стратегию мониторинга, чтобы минимизировать 'alert fatigue' (усталость от алертов) у инженеров?
Похожие вакансии
DevOps Middle +/ Senior
Senior DevOps/SRE
DevOps Middle (Monitoring & Infrastructure)
DevOps инженер (middle)
Senior DevOps / SRE инженер (OpenStack)
DevOps-инженер
1000+ офферов получено
Устали искать работу? Мы найдём её за вас
Quick Offer улучшит ваше резюме, подберёт лучшие вакансии и откликнется за вас. Результат — в 3 раза больше приглашений на собеседования и никакой рутины!