yandex
Страна
Россия
В офисеПолная занятость

SRE в службу разработки динамических таблиц YTsaurus

ИИОценка ИИ

Престижная компания, работа над уникальным Open Source проектом (YTsaurus) и сложные инженерные задачи. Отличный соцпакет, включая международный ДМС.


Вакансия из Quick Offer Global, списка международных компаний
Пожаловаться
+400% приглашений от HR

Улучшите резюме под эту вакансию

Возьмём требования и создадим новую версию резюме с акцентом на нужный опыт

Сложность вакансии

ЛегкоСложно
ИИОценка ИИ

Высокая сложность обусловлена необходимостью глубоких знаний C++, системного программирования и низкоуровневой оптимизации в рамках огромной распределенной системы.

Анализ зарплаты

Медиана350 000 ₽
Рынок250 000 ₽ – 500 000 ₽
ИИОценка ИИ

Яндекс предлагает зарплаты на уровне верхнего дециля рынка для SRE-инженеров такого уровня, часто дополняя их опционной программой. Указанный диапазон соответствует рыночным ожиданиям для Senior/Lead специалистов в РФ.

Сопроводительное письмо

Составьте сопроводительное письмо под эту вакансию с вашим резюме

Иллюстрация сопроводительного письмаИллюстрация сопроводительного письма

Откликнитесь в Яндекс уже сейчас

Присоединяйтесь к команде Яндекса и развивайте одну из самых мощных NewSQL-систем в мире!

Описание вакансии

*❤️ SRE в службу разработки динамических таблиц YTsaurus*

Привет! Я Руслан Савченко, руководитель разработки динтаблиц YTsaurus. Наша команда занимается разработкой и поддержкой сервиса YTsaurus в Яндексе и старается применять на практике лучшие идеи из областей разработки и эксплуатации больших систем. Мы ищем SRE-инженера с фокусом на performance engineering.

Руслан Савченко

Руководитель службы разработки динамических таблиц

Динтаблицы YTsaurus — это многопользовательская NewSQL-СУБД, развёрнутая на тысячи машин и обслуживающая много пользователей и проектов внутри Яндекса. К сервису предъявляются высокие требования по доступности и времени отклика. Вам предстоит разбираться с узкими местами работы системы и вырабатывать решения, нацеленные на их устранение.

Какие задачи вас ждут:

• Оптимизация потребления CPUВам предстоит разобраться во внутренней архитектуре и оптимизировать сервис, чтобы снизить время обработки запросов.

• Диагностика задержек в сетиВам нужно реализовать средство мониторинга сетевых задержек на стороне YTsaurus, чтобы можно было понять, на какой стороне искать причину долгой передачи данных.

• Внедрение SLAВам совместно с другими разработчиками предстоит придумать и внедрить контракт, который был бы понятен как эксплуатации YTsaurus, так и сервисам, хранящим свои базы данных в YTsaurus.

Мы ждём, что вы:• Умеете программировать на C++, готовы писать на Go и Python

• Любите погружаться в особенности работы операционной системы и железа

• Нацелены на построение надёжного сервиса для пользователей

Будет плюсом, если вы:• Работали с низкоуровневыми оптимизациями

• Знакомы с bpftools

• Знаете теорию SRE и то, как выстраиваются SRE-процессы

Почему у нас классно:

ДМС Яндекса действует с первого месяца работы. Причём получить плановую или неотложную помощь можно и за рубежом — так что можно не бояться путешествовать. Это не все бонусы — полный список тут.

*📩* Откликнуться на нашем сайте

#бэкенд #SRE #ytsaurus #CPP #golang #python #новосибирск #екатеринбург #нижнийновгород

+400% к собеседованиям

Создайте идеальное резюме с помощью ИИ-агента

Создайте идеальное резюме с помощью ИИ-агента

Навыки

  • C++
  • Go
  • Python
  • SRE
  • bpftools
  • Performance Engineering
  • NewSQL
  • Linux
  • eBPF

Возможные вопросы на собеседовании

Вакансия сфокусирована на performance engineering, поэтому важно понимать, как кандидат ищет узкие места.

Расскажите о вашем опыте профилирования приложений на C++. Какие инструменты (например, perf, gprof) вы использовали и какие проблемы находили?

В требованиях указаны bpftools, что критично для диагностики сетевых и системных задержек.

Как бы вы использовали eBPF для диагностики аномальных задержек в сетевом стеке на уровне ядра?

Работа с динамическими таблицами требует понимания архитектуры СУБД.

Какие основные факторы влияют на хвостовые задержки (tail latency) в распределенных NewSQL-системах и как их минимизировать?

SRE-роль подразумевает внедрение контрактов надежности.

Как правильно определить SLI и SLO для системы хранения данных, чтобы они были полезны и эксплуатации, и конечным пользователям?

Проверка знаний ОС и управления ресурсами.

Как работает механизм Context Switch в Linux и как избыточное количество переключений контекста влияет на производительность CPU-bound сервиса?

Похожие вакансии

Россия
более 1000 офферов получено
4.9

1000+ офферов получено

Устали искать работу? Мы найдём её за вас

Quick Offer улучшит ваше резюме, подберёт лучшие вакансии и откликнется за вас. Результат — в 3 раза больше приглашений на собеседования и никакой рутины!