yandex
Страна
США
SeniorУдалённоПолная занятость

Senior SRE Engineer / Platform Reliability Engineer

ИИОценка ИИ

Привлекательная вакансия в международной компании с оплатой в USD и возможностью работать удаленно. Четко описанные задачи и современный стек технологий делают позицию интересной для опытных инженеров.

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.


Вакансия из открытого источника
Пожаловаться
+400% приглашений от HR

Улучшите резюме под эту вакансию

Возьмём требования и создадим новую версию резюме с акцентом на нужный опыт

Сложность вакансии

ЛегкоСложно
ИИОценка ИИ

Высокая сложность обусловлена требованием Senior-уровня, необходимостью глубокого понимания методологии SRE (SLI/SLO, Error Budgets) и свободного владения английским языком для работы с заказчиком из США.

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

Анализ зарплаты

Медиана6 000 $
Рынок5 000 $ – 7 500 $
ИИОценка ИИ

Работодатель предлагает оплату в USD, что является значительным преимуществом. Указанный диапазон 5000-7500 USD соответствует рыночным ставкам для Senior SRE специалистов, работающих на американские компании через аутстаффинг.

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

Сопроводительное письмо

Составьте сопроводительное письмо под эту вакансию с вашим резюме

Иллюстрация сопроводительного письмаИллюстрация сопроводительного письма

Описание вакансии

Senior SRE Engineer / Platform Reliability Engineer

*🏢* Компания: Nitka Technologies

*💰* ЗП: Привлекательная оплата в USD

*🌍* Формат: Удалёнка (заказчик — США)

*🕒* Занятость: Полная занятость

О компании:

Nitka Technologies — международная IT‑компания, которая разрабатывает ПО для клиентов в США и Европе. В команде около 300 специалистов из Восточной Европы, Америк, Армении, Грузии и Казахстана. Специализация — кастомная разработка и IT‑консалтинг.

Задачи:

• Определять и внедрять практичные SLI/SLO вместе с сервисными командами.

• Настроить SLO‑ориентированный алертинг и отслеживание error budget.

• Анализировать инциденты, повторяющиеся отказы и риски надёжности.

• Снижать шум алертов и повышать качество оповещений.

• Автоматизировать повторяющиеся операционные задачи и повышать безопасность деплоев.

• Внедрять и улучшать мониторинг, дашборды и runbooks.

Требования:

• Уверенный опыт работы в production support или на позиции SRE.

• Практический опыт с Prometheus, Grafana, CloudWatch, Splunk, Datadog или аналогичными инструментами.

• Опыт инцидент‑менеджмента: runbooks и постмортемы.

• Опыт работы с Azure и инструментами Infrastructure as Code (Terraform или аналог).

• Опыт с CI/CD и контейнерными кластерами (AKS).

• Скриптование на Python/Bash/Go; понимание концепций SLI/SLO и OpenTelemetry; уверенный английский (Intermediate+).

Стек:

Azure, AKS, Prometheus, Grafana, CloudWatch, Splunk, Datadog, OpenTelemetry, Terraform, CI/CD, Python, Bash, Go

Условия:

• Удалённая работа

• Полная занятость (8 часов/день)

• Привлекательная оплата в USD

• Оплачиваемый отпуск и праздники

*📩* Откликнуться

Больше похожих вакансий + автоотклики с ИИ

Умный подбор, сопроводительные письма, советы по отказам — больше приглашений.

Больше похожих вакансий + автоотклики с ИИ

Навыки

  • Azure
  • AKS
  • Prometheus
  • Grafana
  • CloudWatch
  • Splunk
  • Datadog
  • OpenTelemetry
  • Terraform
  • CI/CD
  • Python
  • Bash
  • Go
  • SRE

Возможные вопросы на собеседовании

Проверка понимания фундаментальных концепций SRE и умения применять их на практике.

Расскажите о вашем опыте внедрения SLI/SLO: как вы выбирали метрики и как определяли допустимый бюджет ошибок (Error Budget)?

Оценка навыков инцидент-менеджмента и способности извлекать уроки из сбоев.

Опишите самый сложный инцидент в вашей практике. Как вы его локализовали и какие меры предприняли в рамках постмортема, чтобы это не повторилось?

Проверка технических навыков работы с облачной инфраструктурой Azure.

С какими специфическими проблемами масштабирования или надежности в Azure Kubernetes Service (AKS) вы сталкивались и как их решали?

Оценка навыков автоматизации и борьбы с рутиной (toil).

Какие операционные задачи вам удалось автоматизировать с помощью Python или Go в последнее время, и какой эффект это дало команде?

Проверка владения инструментами мониторинга и наблюдаемости.

Как бы вы организовали мониторинг распределенной системы с использованием OpenTelemetry для быстрого поиска узких мест в производительности?

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

Похожие вакансии

США
более 1000 офферов получено
4.9

1000+ офферов получено

Устали искать работу? Мы найдём её за вас

Quick Offer улучшит ваше резюме, подберёт лучшие вакансии и откликнется за вас. Результат — в 3 раза больше приглашений на собеседования и никакой рутины!