- Страна
- Польша
AI Inference Engineer
Интересная роль в AI-фокусной компании с современным стеком технологий. Наличие русскоговорящей команды в Польше облегчает адаптацию, а работа с передовыми инструментами вроде MLC LLM дает отличные перспективы для профессионального роста.
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.
Улучшите резюме под эту вакансию
Возьмём требования и создадим новую версию резюме с акцентом на нужный опыт
Сложность вакансии
Высокая сложность обусловлена требованием глубоких знаний в узкоспециализированных фреймворках оптимизации (TensorRT, TVM, ExecuTorch) и уверенного владения C++ на протяжении 4 лет. Работа с инференсом LLM требует понимания архитектуры железа и низкоуровневой оптимизации.
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.
Анализ зарплаты
Зарплата в объявлении не указана, но для позиции AI Inference Engineer с опытом 4 года в Польше рыночные показатели находятся в диапазоне выше среднего для IT-сектора. Специалисты по оптимизации инференса сейчас крайне востребованы из-за бума LLM.
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.
Контакты для отклика
Откройте контакты, указанные в вакансии.
Описание вакансии
AI Inference Engineer в ITRex
*📍*Польша
*💎*4 года работы, C++, ONNX Runtime, TensorRT / TensorRT-LLM, OpenVINO, MLC LLM, ExecuTorch, TVM
*🚀*В компании работает много русскоговорящих ребят
ITRex — AI/ML-ориентированная продуктово-инжиниринговая компания.
Размер команды — 201-500
Узнать подробнее и откликнуться: Откликнуться
Создайте идеальное резюме с помощью ИИ-агента

Навыки
- C++
- ONNX Runtime
- TensorRT
- TensorRT-LLM
- OpenVINO
- MLC-LLM
- ExecuTorch
- TVM
- AI
- Machine Learning
Возможные вопросы на собеседовании
Проверка понимания специфики работы с тензорными ядрами и оптимизации под конкретное железо NVIDIA.
Расскажите о вашем опыте оптимизации LLM с использованием TensorRT-LLM: какие техники квантования вы применяли и как это повлияло на latency?
Важно понять, умеет ли кандидат выбирать правильный инструмент под задачу (CPU vs GPU vs Edge).
В каких случаях вы предпочтете использовать OpenVINO вместо ONNX Runtime, и наоборот? Приведите примеры из практики.
Проверка навыков работы с мобильными и встраиваемыми устройствами.
Каков ваш опыт работы с ExecuTorch? С какими основными трудностями вы сталкивались при деплое моделей на мобильные платформы?
Оценка навыков написания производительного кода.
Какие паттерны C++ наиболее критичны для обеспечения минимального оверхеда при написании оберток для инференс-движков?
Проверка знаний в области компиляторов глубокого обучения.
Как работает TVM Relay и в чем преимущество использования TVM по сравнению с нативными библиотеками вендоров?
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

