yandex
Страна
Россия
Зарплата
269 000 ₽ – 413 000 ₽
+500% приглашений

Откликайтесь
на вакансии с ИИ

Ускорим процесс поиска работы
MiddleУдалённоПолная занятость

Middle Data Scientist (CV/OCR)

ИИОценка ИИ

Сильный бренд работодателя, прозрачная и конкурентная зарплатная вилка, работа с передовым стеком (VLM, OCR) и возможность удаленной работы.


Вакансия из Quick Offer Global, списка международных компаний
Пожаловаться

Сложность вакансии

ЛегкоСложно
ИИОценка ИИ

Позиция требует глубоких знаний в узких областях (OCR, VLM) и 3+ года опыта. Высокие требования к навыкам вывода моделей в прод и оптимизации инференса для высоких нагрузок.

Анализ зарплаты

Медиана320 000 ₽
Рынок250 000 ₽ – 400 000 ₽
ИИОценка ИИ

Предложенная вилка 269–413К 'на руки' полностью соответствует и даже немного превышает среднерыночные показатели для Middle Data Scientist в Москве, которые обычно варьируются от 250 до 350 тысяч рублей. Верхняя граница в 413К является очень привлекательной для данного грейда.

Сопроводительное письмо

Меня заинтересовала вакансия Middle Data Scientist в команду Horizontal ML Technologies, так как мой опыт в области Computer Vision и разработки OCR-систем напрямую соответствует вашим задачам. Я обладаю глубокими знаниями архитектур CNN и трансформеров, а также имею практический опыт работы с VLM и оптимизацией инференса для высоконагруженных сервисов.

В Авито меня привлекает возможность работать над сложными пайплайнами детекции и распознавания текста, которые напрямую влияют на безопасность и удобство платформы. Я уверен, что мои навыки в PyTorch, OpenCV и опыт доведения ML-проектов до продакшена позволят мне эффективно развивать вашу OCR-платформу и внедрять инновационные VLM-решения.

+250% к просмотрам

Составьте идеальное письмо к вакансии с ИИ-агентом

Составьте идеальное письмо к вакансии с ИИ-агентом

Откликнитесь в Авито уже сейчас

Присоединяйтесь к команде Horizontal ML в Авито и создавайте передовые OCR и CV решения для миллионов пользователей!

Описание вакансии

tldr: Авито, Middle Data Scientist (CV/OCR), 269–413К на руки

Ищем Middle Data Scientist в команду Horizontal ML Technologies в Авито. Команда развивает горизонтальные ML-технологии: OCR, компьютерное зрение и VLM. Решения используются в модерации, антифроде и распознавании документов.

Над чем предстоит работать:

🖇 развивать OCR-платформу: улучшать распознавание текущих типов документов и добавлять новые;

🖇 строить CV/OCR-пайплайны: детекция и распознавание текста, классификация, оценка качества изображений, пре- и постпроцессинг;

🖇 разрабатывать VLM-решения: fine-tuning через LoRA, prompting, проектирование архитектуры и оценка качества;

🖇 собирать и размечать данные, в том числе генерировать синтетические датасеты;

🖇 оптимизировать инференс и выкатывать модели в прод высоконагруженных сервисов.

Что ожидается от кандидата:

🖇 3+ года практического опыта с ML-моделями в Computer Vision;

🖇 умение самостоятельно вести CV-проекты от идеи до продакшена;

🖇 хорошее понимание CNN и трансформеров для классификации, детекции и сегментации;

🖇 практический опыт с современными VLM;

🖇 уверенный Python, PyTorch и знание классического CV/OpenCV;

🖇 опыт оптимизации и вывода моделей в прод.

Опыт с OCR и Go будет плюсом.

Вилка: 269–413К на руки

Формат: Москва / удалёнка, можно работать из офисов Авито.

Вакансия: Откликнуться

Писать: Откликнуться

PS: также есть открытые вакансии middle+/senior в команды LLM, автомодерации, рекомендаций и тд.

+400% к собеседованиям

Создайте идеальное резюме с помощью ИИ-агента

Создайте идеальное резюме с помощью ИИ-агента

Навыки

  • Python
  • OpenCV
  • PyTorch
  • Computer Vision
  • LoRA
  • Transformers
  • OCR
  • Go
  • CNN
  • VLM

Возможные вопросы на собеседовании

Проверка практического опыта в ключевой задаче команды.

Расскажите о вашем опыте построения OCR-пайплайнов: какие архитектуры для детекции и распознавания текста вы использовали и как боролись с шумами?

Вакансия предполагает работу с современными мультимодальными моделями.

В чем заключаются особенности fine-tuning VLM через LoRA по сравнению с полным дообучением, и какие метрики качества вы считаете приоритетными?

Важно для работы в высоконагруженных сервисах Авито.

Какие методы оптимизации инференса (квантование, прунинг, TensorRT) вы применяли на практике для CV-моделей?

Проверка навыков работы с данными, указанных в описании.

Как вы подходите к генерации синтетических данных для задач OCR, чтобы минимизировать domain shift при переходе к реальным документам?

Оценка самостоятельности и понимания жизненного цикла ML-проекта.

Опишите случай, когда вам пришлось самостоятельно вести CV-проект от идеи до продакшена: с какими основными трудностями вы столкнулись на этапе деплоя?

Похожие вакансии

Россияот 269 000 ₽
более 1000 офферов получено
4.9

1000+ офферов получено

Устали искать работу? Мы найдём её за вас

Quick Offer улучшит ваше резюме, подберёт лучшие вакансии и откликнется за вас. Результат — в 3 раза больше приглашений на собеседования и никакой рутины!