yandex
Страна
Россия
Зарплата
200 000 ₽ – 250 000 ₽
+500% приглашений

Откликайтесь
на вакансии с ИИ

Ускорим процесс поиска работы
ГибридКонтракт

QA (ML/LLM)

ИИОценка ИИ

Интересный проект на острие технологий (LLM/ML) для крупного заказчика. Хорошая вилка оплаты, хотя формат работы предполагает обязательное посещение офиса в Москве в начале пути.


Вакансия из Quick Offer Global, списка международных компаний
Пожаловаться

Сложность вакансии

ЛегкоСложно
ИИОценка ИИ

Роль требует специфического опыта на стыке классического QA и ML, включая понимание работы LLM и умение работать с GreenPlum. Высокая планка по SQL и Python делает позицию сложной для обычных тестировщиков.

Анализ зарплаты

Медиана280 000 ₽
Рынок230 000 ₽ – 350 000 ₽
ИИОценка ИИ

Предложенная зарплата (200-250к) соответствует рыночному уровню для Middle+/Senior QA в Москве, однако для узкой специализации ML/LLM это скорее нижняя граница рынка. Специалисты с таким редким стеком часто претендуют на суммы от 300 000 ₽.

Сопроводительное письмо

Меня заинтересовала вакансия QA (ML/LLM) в компании «Цифровые привычки», так как я обладаю необходимым опытом тестирования сложных ML-систем и уверенно владею Python и SQL. Мой опыт позволяет мне не только проводить стандартное тестирование, но и выстраивать процессы оценки качества ответов LLM-агентов, включая работу с метриками и автоматизацию через LLM Judge.

Я имею глубокое понимание специфики больших языковых моделей, таких как недетерминированность и галлюцинации, и умею эффективно работать с промптами. Уверен, что мои навыки в автоматизации тестов и анализе инцидентов помогут обеспечить высокое качество релизов в рамках проекта Сбера. Буду рад обсудить, как мой опыт поможет вашей команде в развитии SQL-агентов и систем визуализации.

+250% к просмотрам

Составьте идеальное письмо к вакансии с ИИ-агентом

Составьте идеальное письмо к вакансии с ИИ-агентом

Откликнитесь в Цифровые привычки уже сейчас

Присоединяйтесь к команде «Цифровые привычки» и станьте экспертом в тестировании передовых LLM-решений для Сбера!

Описание вакансии

QA (ML/LLM) в компанию Цифровые привычки

Проект Сбера по развитию и тестированию ML/LLM-систем в компании Цифровые привычки.

*📝 Обязанности*

Выстроить систему оценки качества ответов LLM-агентов (SQL-агент, агент анализа, агент визуализации): метрики, критерии, процесс;

Развивать и сопровождать тестовые корзины для регрессионного тестирования: эталонные вопросы, ожидаемые SQL-запросы и ответы;

Автоматизировать прогон тестов и оценку по бинарным критериям (валидность JSON, исполнимость SQL, отсутствие галлюцинаций, корректность ролевого доступа, консистентность ответов), в том числе через LLM Judge;

Проводить сравнительное тестирование моделей и версий промптов, готовить отчёты для принятия решений;

Тестировать релизы перед выводом в пром, выявлять расхождения поведения между тестовым и промышленным контурами;

Анализировать инциденты качества в проме, локализовывать причины (промпт / модель / данные / код).

*🔍 Требования*

Опыт QA от 3 лет, из них опыт тестирования ML/LLM-систем;

Уверенный SQL (у нас GreenPlum) — умение читать и проверять чужие запросы, находить логические ошибки;

Python для автоматизации тестов и обработки результатов;

Понимание специфики LLM: недетерминированность, галлюцинации, чувствительность к промптам.

*💎 Будет преимуществом*

Опыт работы с фреймворками оценки LLM (Ragas, DeepEval) или построения своих;

Опыт с LangChain/LangGraph;

Знание банковской предметной области, финансовой отчётности (P&L);

Опыт тестирования data-продуктов: витрины, ETL, качество данных.

*🕹 Условия*

Трудоустройство: ИП или ГПХ;

Зарплата: от 200 000 ₽ до 250 000 ₽;

Формат работы: первые 3 месяца офис, далее гибрид (офис в Москве);

Локация: Москва.

*📞 Контакты*

+400% к собеседованиям

Создайте идеальное резюме с помощью ИИ-агента

Создайте идеальное резюме с помощью ИИ-агента

Навыки

  • Python
  • LLM
  • SQL
  • ETL
  • Data Quality
  • LangChain
  • LangGraph
  • QA
  • DeepEval
  • Ragas
  • ML
  • Greenplum

Возможные вопросы на собеседовании

Проверка понимания фундаментальной проблемы LLM и подходов к её решению.

Как вы планируете бороться с недетерминированностью ответов LLM при автоматизации регрессионного тестирования?

Оценка практического опыта работы с современными инструментами оценки качества генеративных моделей.

Расскажите о вашем опыте использования LLM Judge: какие промпты и критерии вы использовали для оценки?

Проверка навыков работы с данными, критически важных для SQL-агентов.

С какими особенностями GreenPlum вы сталкивались при проверке сложных аналитических запросов?

Оценка умения работать с бизнес-логикой и спецификой банковских данных.

Как бы вы организовали тестовую корзину для проверки корректности расчета P&L финансовым агентом?

Проверка навыков локализации проблем в сложных распределенных системах.

Если SQL-агент выдает неверный результат, как вы будете определять, где ошибка: в промпте, в самой модели или в качестве данных в витрине?

Похожие вакансии

Россияот 200 000 ₽
более 1000 офферов получено
4.9

1000+ офферов получено

Устали искать работу? Мы найдём её за вас

Quick Offer улучшит ваше резюме, подберёт лучшие вакансии и откликнется за вас. Результат — в 3 раза больше приглашений на собеседования и никакой рутины!