yandex
+500% приглашений

Откликайтесь
на вакансии с ИИ

Ускорим процесс поиска работы
УдалённоПолная занятость

AI Test Automation Engineer

ИИОценка ИИ

Отличная вакансия для опытных инженеров: работа с передовым стеком (AI/LLM), международные проекты, полная удаленка и расширенный соцпакет, включая обучение языкам.


Вакансия из Quick Offer Global, списка международных компаний
Пожаловаться

Сложность вакансии

ЛегкоСложно
ИИОценка ИИ

Высокая сложность обусловлена необходимостью совмещать навыки классической автоматизации (PyTest, Playwright) с глубокой экспертизой в области AI/ML (LLM evaluation, guardrails) и DevOps (Kubernetes, canary releases).

Анализ зарплаты

Медиана5 500 $
Рынок4 500 $ – 7 000 $
ИИОценка ИИ

Для позиции уровня Senior AI QA Automation на международном рынке зарплаты обычно начинаются от 4500-5000 USD. Предложение Новео конкурентоспособно для РФ и СНГ, учитывая формат работы через ИП и дополнительные бонусы.

Сопроводительное письмо

Меня крайне заинтересовала вакансия AI Test Automation Engineer в компании Новео. Мой опыт разработки автотестов на Python и TypeScript в сочетании с глубоким пониманием специфики LLM (LLM-as-a-Judge, оценка галлюцинаций и предвзятости) идеально соответствует вашим задачам по обеспечению качества AI-продуктов.

Я имею практический опыт работы с CI/CD процессами, включая настройку quality gates и мониторинг SLO. Работа с такими технологиями, как Playwright, Kubernetes и Azure Application Insights, является частью моей ежедневной практики. Буду рад применить свои навыки для развития фреймворков тестирования и улучшения метрик качества вашей Voice AI-платформы.

+250% к просмотрам

Составьте идеальное письмо к вакансии с ИИ-агентом

Составьте идеальное письмо к вакансии с ИИ-агентом

Откликнитесь в Новео уже сейчас

Присоединяйтесь к международной команде Новео и станьте экспертом в тестировании передовых AI-решений!

Описание вакансии

**AI Test Automation Engineer

Новео, удаленно**

Мы — международная IT-компания НОВЕО. С 2002 г. занимаемся проектами по заказной разработке ПО для западноевропейского рынка.

Компанию отличает продуктовый подход к разработке и плотная интеграция специалистов в распределенную команду, что позволяет им напрямую влиять на техническое решение, качество кода и конечный результат.

Мы ждём от тебя:

*💦Опыт написания production-ready автотестов на Python (PyTest) и TypeScript (Playwright)* — чистый, читаемый, поддерживаемый код, проходящий code review;

*💦Практический опыт разработки или внедрения подходов к оценке качества LLM/AI-моделей (LLM evaluation): LLM-as-a-Judgerubric-based scoringsemantic similarity* или аналогичных методов;

*💦Опыт работы с CI/CD в облачной инфраструктуре: использование canary-релизов, автоматических quality gates и механизмов автоматического отката (rollback*) при возникновении проблем;

*💦Опыт определения, измерения и контроля SLO (Service Level Objectives) для AI/ML-сервисов, включая такие показатели, как latencyaccuracy и reliability*, а также автоматизации контроля этих метрик;

*💦*Опыт совместной работы с ML-инженерами: понимание особенностей работы с датасетами, результатами инференса моделей и метриками оценки качества (evaluation metrics);

*💦Уверенный письменный и разговорный английский язык (B2+ , C1).*

Задачи:

*🌸Разрабатывать и развивать фреймворки автоматизированного тестирования (PyTest, Playwright, k6) для четырех AI-продуктов, обеспечивая прохождение автоматических проверок качества (quality gates) для каждого Pull Request и canary-развертывания в Kubernetes-кластере Nebius;*

*🌸Отвечать за критерии автоматического отката (rollback) AI-моделей, качество canary- и A/B-развертываний, а также ежедневно анализировать и устранять проблемы в Kubernetes-кластере с использованием kubectl;*

*🌸Разрабатывать комплексные стратегии end-to-end тестирования, охватывающие API-контракты, обработку потоковых событий (event streams) и моделирование сценариев взаимодействия пользователей через различные каналы связи, включая LiveKitPSTN и WebRTC;*

*🌸Создавать инструменты для оценки качества LLM-моделей, включая LLM-as-a-Judgerubric-based scoring*, выявление аномалий (anomaly detection), а также тестирование защитных механизмов (guardrails) для обнаружения предвзятости (bias), галлюцинаций (hallucinations), токсичного контента (toxicity) и утечек персональных данных (PII) на всех поддерживаемых языках;

*🌸Совместно с командами R&D и ML Engineering* разрабатывать датасеты для оценки качества моделей и предоставлять структурированные результаты тестирования, способствующие их дальнейшему улучшению;

*🌸Определять и развивать систему SLO (Service Level Objectives) для Voice AI-платформы, организовывать мониторинг качества работы в production с использованием Azure Application Insights*, а также готовить регулярные отчеты по качеству продукта для руководства компании.

Что ты получаешь:

*☘️*Трудоустройство через договор с ИП/самозанятым без привязки к определенному местонахождению;

*☘️*Оплачиваемый отпуск и больничные;

*☘️*Стабильную долгосрочную загрузку (8 часов в день, 40 часов в неделю), гибкий график, гибридный формат работы;

*☘️*Работу в профессиональной распределенной команде над интересными проектами;

*☘️*Продуманный онбординг с опытным наставником, возможность изучения новых технологий и их применение в проектах, внутреннее обучение, митапы, tech talks и прокачка технических навыков;

*☘️*Сильную команду специалистов, четко выстроенные процессы;

*☘️*Бесплатное изучение иностранных языков в рабочее время с преподавателями компании (английский, французский);

*☘️*Компенсацию медицинских услуг, массажа или спорта (внутренний аналог ДМС).

Откликнуться

#engineer #remote

+400% к собеседованиям

Создайте идеальное резюме с помощью ИИ-агента

Создайте идеальное резюме с помощью ИИ-агента

Навыки

  • Python
  • PyTest
  • TypeScript
  • Playwright
  • CI/CD
  • Kubernetes
  • k6
  • Azure Application Insights
  • WebRTC
  • LLM
  • ML
  • API Testing

Возможные вопросы на собеседовании

Проверка практического опыта в специфической области тестирования LLM.

Расскажите о вашем опыте внедрения подхода LLM-as-a-Judge: какие модели вы использовали в качестве судьи и как боролись с их предвзятостью?

Вакансия предполагает работу с Voice AI и потоковыми данными.

Как бы вы организовали end-to-end тестирование для системы, использующей WebRTC и LiveKit, чтобы минимизировать задержки (latency)?

Оценка навыков работы с инфраструктурой и обеспечения надежности.

Опишите процесс настройки автоматических Quality Gates для canary-развертывания в Kubernetes: по каким метрикам вы бы принимали решение об откате?

Проверка понимания безопасности и этики в AI.

Какие методы вы применяете для автоматизированного обнаружения галлюцинаций и утечек персональных данных (PII) в ответах моделей?

Оценка умения работать с бизнес-метриками.

Как вы определяете и измеряете SLO для AI-сервисов, и какие инструменты мониторинга, помимо Azure Application Insights, вы считаете наиболее эффективными?

Похожие вакансии

NDA
2 300 € – 2 800 €

Middle/Senior QA Automation

SeniorУдалённо
TypeScript · PHP · Cypress · Playwright · k6 · JavaScript · SQL · Agile · Scrum · API Testing · UI Testing · React · Docker · CI/CD · Shell
+15 навыков
NDA
165 000 ₽

Инженер по тестированию (Middle)

MiddleУдалённо
Java · SQL · API Testing · WebSocket · Jira · Zephyr · Agile · Scrum · Bash · Selenium WebDriver · Playwright · Regression Testing · Smoke Testing
+13 навыков
M
Maxilect
200 000 ₽ – 260 000 ₽

Senior QA Engineer (Fullstack, Java)

SeniorУдалённо
QA · Java · REST API · SOAP · Kafka · RabbitMQ · SQL · Docker · Kubernetes · CI/CD · Microservices · Automated Testing
+12 навыков
OS
Omega Solution
от 4 000 €

AQA engineer

SeniorУдалённо
Kotlin · Python · Java · TypeScript · API Testing · Postman · iOS · Android · CI/CD · Jenkins · GitLab CI · GitHub Actions · Docker · Kubernetes · Pact · Bash · Zsh · Jira · Tableau · GitHub Copilot · ChatGPT · Claude
+22 навыков
A
ATSystems
3 000 $ – 5 000 $

QA Automation Engineer

Удалённо
TypeScript · JavaScript · Node.js · Playwright · API Testing · SQL · BigQuery · ClickHouse · PostgreSQL · Kafka · RabbitMQ · Google Cloud Platform · Docker · Kubernetes · Load Testing
+15 навыков
V
VB&Co
2 500 $ – 3 700 $

Senior AQA / SDET (Backend)

SeniorУдалённо
C++ · NUnit · xUnit · SQL · GitLab CI/CD · Docker · Git · Linux · MySQL · Selenium · Playwright · API Testing
+12 навыков
более 1000 офферов получено
4.9

1000+ офферов получено

Устали искать работу? Мы найдём её за вас

Quick Offer улучшит ваше резюме, подберёт лучшие вакансии и откликнется за вас. Результат — в 3 раза больше приглашений на собеседования и никакой рутины!