- Страна
- Россия
- Зарплата
- 250 000 ₽ – 350 000 ₽
Откликайтесь
на вакансии с ИИ

Data Scientist Middle/Senior Scoring
Сильный бренд работодателя, возможность удаленной работы и конкурентная вилка зарплаты. Стек технологий современный и востребованный на рынке, что обеспечивает профессиональный рост.
Сложность вакансии
Позиция требует уверенного владения PySpark и глубокого понимания статистики, а также специфического опыта в скоринге или финтехе. Высокая планка по опыту (от 2 лет в DS) и знанию структур данных делает отбор достаточно строгим.
Анализ зарплаты
Указанный в описании диапазон 250 000 – 350 000 ₽ полностью соответствует текущим рыночным ожиданиям для специалистов уровня Middle+/Senior в Москве и крупных тех-хабах. Это конкурентное предложение, учитывая возможность удаленной работы.
Сопроводительное письмо
Составьте идеальное письмо к вакансии с ИИ-агентом

Откликнитесь в Билайн уже сейчас
Присоединяйтесь к команде билайна и создавайте передовые скоринговые модели для миллионов пользователей!
Описание вакансии
Data Scientist Middle/Senior Scoring в билайн
*💰*По итогам собеседования (ср. рын. зп 250 000 ₽ – 350 000 ₽)
*📌*Условия и бонусы:
Фултайм, офис или удаленно.
*📌*Наши ожидания:
– Успешный профессиональный опыт работы в финтех индустрии не менее 1 года, или стаж в DS и ML более 2 лет.
– Опыт построения моделей с помощью классического ML-стека.
– Навыки работы с Python, (py)Spark, SQL, уверенные знания теории вероятности и статистики.
– Понимание ООП и структур данных.
– Кейсы с применением собственных методик в анализе данных и построении моделей на табличных данных.
– Хорошие отношения с Git, Jira, Confluence.
*✍🏼*Откликнуться
Создайте идеальное резюме с помощью ИИ-агента

Навыки
- Git
- Python
- Machine Learning
- SQL
- Statistics
- PySpark
- Confluence
- Jira
- Probability Theory
- OOP
Возможные вопросы на собеседовании
Скоринг часто строится на табличных данных, где градиентный бустинг является стандартом.
Какие методы борьбы с переобучением в моделях градиентного бустинга (XGBoost/LightGBM/CatBoost) вы считаете наиболее эффективными для задач скоринга?
В билайне огромные объемы данных, поэтому навыки оптимизации запросов критичны.
Расскажите о вашем опыте оптимизации PySpark-джобов. Как вы справляетесь с проблемой перекоса данных (data skew)?
Для скоринга важно понимать не только точность, но и стабильность модели.
Какие метрики, помимо ROC-AUC, вы используете для оценки качества скоринговых моделей? Как вы оцениваете стабильность модели во времени (PSI, CSI)?
В требованиях указано понимание ООП.
Как вы применяете принципы ООП при разработке ML-пайплайнов? Можете привести пример, когда это помогло в поддержке кода?
Проверка фундаментальных знаний.