yandex
Страна
Россия
ГибридПолная занятость

SRE-инженер в команду AI-агентов Фантеха

ИИОценка ИИ

Отличная вакансия в топовой технологической компании с сильной инженерной культурой, интересными задачами на стыке SRE и AI, а также расширенным социальным пакетом.

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.


Вакансия из открытого источника
Пожаловаться
+400% приглашений от HR

Улучшите резюме под эту вакансию

Возьмём требования и создадим новую версию резюме с акцентом на нужный опыт

Сложность вакансии

ЛегкоСложно
ИИОценка ИИ

Высокая сложность обусловлена необходимостью глубоких знаний Linux, сетевых протоколов и инструментов автоматизации (K8s, Terraform), а также спецификой работы с AI-сервисами и дежурствами.

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

Анализ зарплаты

Медиана350 000 ₽
Рынок250 000 ₽ – 500 000 ₽
ИИОценка ИИ

Зарплата в Яндексе для SRE-инженеров обычно соответствует верхнему децилю рынка, учитывая не только оклад, но и годовые бонусы, а также опционные программы (RSU). Указанный диапазон отражает рыночные ожидания для специалистов уровня Senior в Москве и Санкт-Петербурге.

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

Сопроводительное письмо

Составьте сопроводительное письмо под эту вакансию с вашим резюме

Иллюстрация сопроводительного письмаИллюстрация сопроводительного письма

Описание вакансии

*🤍* SRE-инженер в команду AI-агентов Фантеха

Привет! Я Лёша, руковожу службой разработки AI‑продуктов в Фантехе. Ищу SRE-инженера, который поможет нам повышать надёжность работающих AI‑сервисов, развивать наблюдаемость и готовить инфраструктуру для новых микросервисов.

Алексей Хохулин, руководитель службы

Какие задачи вас ждут:

• Обеспечивать надёжность AI‑сервисов

Следить за состоянием сервисов, участвовать в дежурствах, диагностировать нештатные ситуации и устранять их причины, восстанавливать работу системы и снижать вероятность повторения сбоев.

• Развивать наблюдаемость

Улучшать мониторинг, логирование и алертинг, определять критичные показатели сервисов и внедрять практики SLI, SLO и error budget.

• Помогать запускать микросервисы

Вместе с разработчиками проектировать инфраструктуру новых компонентов, настраивать их развёртывание и интеграцию с общей платформой.

• Автоматизировать эксплуатацию

Писать инструменты на Python, развивать CI/CD и автоматизировать создание и настройку инфраструктуры.

• Развивать инженерные практики

Участвовать в проектировании отказоустойчивых решений, разбирать инциденты и помогать команде улучшать процессы разработки и эксплуатации.

Мы ждём, что вы:

• Работали с Linux или другими Unix-системами и умеете диагностировать системные проблемы

• Понимаете сетевые протоколы, DNS, HTTP, балансировку и маршрутизацию

• Умеете строить мониторинг, анализировать логи и настраивать алерты

• Программируете на Python

• Работали с Kubernetes, Terraform, Ansible или аналогами

Что мы предлагаем:

Работа с нами — это забота о семье. Мы компенсируем 80% ДМС супругам и детям яндексоидов. А ещё оплачиваем ведение беременности и роды сотрудницам и жёнам сотрудников, которые с нами более двух лет. Это не все бонусы —полный список тут.

*📩*{{apply_contact}}на нашем сайте

#плюс_фантех #SRE #python #SQL #unix_linux #гибрид #офис #москва #питер

Больше похожих вакансий + автоотклики с ИИ

Умный подбор, сопроводительные письма, советы по отказам — больше приглашений.

Больше похожих вакансий + автоотклики с ИИ

Навыки

  • SRE
  • Linux
  • Unix
  • DNS
  • HTTP
  • Python
  • Kubernetes
  • Terraform
  • Ansible
  • CI/CD
  • Monitoring
  • Logging
  • Alerting
  • SLI
  • SLO

Возможные вопросы на собеседовании

Проверка практического опыта работы с инцидентами и аналитического мышления.

Расскажите о самом сложном инциденте в вашей практике: как вы его диагностировали и какие меры приняли, чтобы он не повторился?

Оценка понимания ключевых метрик надежности, упомянутых в вакансии.

Как бы вы подошли к определению SLI и SLO для нового AI-микросервиса с нуля?

Проверка навыков автоматизации и владения Python.

Какие задачи по эксплуатации инфраструктуры вы автоматизировали с помощью Python? Опишите архитектуру решения.

Проверка знаний Kubernetes и сетевого взаимодействия.

Как организована балансировка трафика в Kubernetes и с какими проблемами на уровне DNS или HTTP вы сталкивались в кластерах?

Оценка навыков работы с Infrastructure as Code.

В чем, по вашему мнению, основные риски при использовании Terraform в большой команде и как их минимизировать?

Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

Похожие вакансии

Россия
более 1000 офферов получено
4.9

1000+ офферов получено

Устали искать работу? Мы найдём её за вас

Quick Offer улучшит ваше резюме, подберёт лучшие вакансии и откликнется за вас. Результат — в 3 раза больше приглашений на собеседования и никакой рутины!