Откликайтесь
на вакансии с ИИ

Site Reliability Engineer (SRE)
Отличная вакансия в известной международной компании с возможностью удаленной работы из любой точки мира и стеком современных технологий.
Сложность вакансии
Высокая сложность обусловлена необходимостью глубоких знаний в области Kubernetes, Terraform и сетевой инфраструктуры (WAF, CDN, DNS), а также ответственностью за стабильность высоконагруженных платформ.
Анализ зарплаты
Предлагаемая роль SRE уровня Middle+/Senior в международной компании обычно предполагает оклад выше среднего по рынку СНГ, соответствуя европейским или глобальным стандартам для удаленных сотрудников.
Сопроводительное письмо
Составьте идеальное письмо к вакансии с ИИ-агентом

Откликнитесь в Social Discovery Group уже сейчас
Присоединяйтесь к Social Discovery Group и обеспечьте надежность глобальных платформ — откликайтесь прямо сейчас!
Описание вакансии
Published time: 2026-09-03
Company name: Social Discovery Group
Title: Site Reliability Engineer (SRE)
Grades: middle+, senior
Job description: Keep Social Discovery Group's social entertainment platforms healthy and fast: monitor system health, investigate incidents and improve observability, drive CI/CD improvements alongside Development, QA and DevOps, tune monitoring and alerting to cut downtime, and support DNS, WAF, CDN and caching infrastructure while maintaining runbooks and operational documentation.
Location: Worldwide
Anywhere: Yes
Remote: Yes
Tags:
#devops #sre #kubernetes #docker #terraform #ansible #gitlab_ci #prometheus #grafana #linux #remote #worldwide #full_time
Создайте идеальное резюме с помощью ИИ-агента

Навыки
- Linux
- Terraform
- Kubernetes
- Prometheus
- Grafana
- Docker
- Ansible
- DNS
- GitLab CI
- CDN
- WAF
Возможные вопросы на собеседовании
SRE должен уметь быстро находить причины сбоев в распределенных системах.
Опишите ваш алгоритм действий при получении алерта о резком росте 5xx ошибок на одном из микросервисов.
Проверка навыков автоматизации и управления инфраструктурой как кодом.
Как вы организуете структуру Terraform-модулей для управления ресурсами в нескольких окружениях (dev/prod)?
Важно понимать, как кандидат балансирует между надежностью и скоростью разработки.
Что такое Error Budgets и как вы будете действовать, если лимит ошибок на месяц исчерпан?
Проверка опыта работы с контейнеризацией и оркестрацией.
С какими проблемами производительности Kubernetes вы сталкивались и как их решали (например, CPU Throttling или OOMKilled)?
Оценка навыков работы с сетевым уровнем и кэшированием.