- Страна
- Польша
Откликайтесь
на вакансии с ИИ

AI Inference Engineer
Интересная роль в AI-фокусной компании с современным стеком технологий. Наличие русскоговорящей команды в Польше облегчает адаптацию, а работа с передовыми инструментами вроде MLC LLM дает отличные перспективы для профессионального роста.
Сложность вакансии
Высокая сложность обусловлена требованием глубоких знаний в узкоспециализированных фреймворках оптимизации (TensorRT, TVM, ExecuTorch) и уверенного владения C++ на протяжении 4 лет. Работа с инференсом LLM требует понимания архитектуры железа и низкоуровневой оптимизации.
Анализ зарплаты
Зарплата в объявлении не указана, но для позиции AI Inference Engineer с опытом 4 года в Польше рыночные показатели находятся в диапазоне выше среднего для IT-сектора. Специалисты по оптимизации инференса сейчас крайне востребованы из-за бума LLM.
Сопроводительное письмо
Составьте идеальное письмо к вакансии с ИИ-агентом

Откликнитесь в ITRex уже сейчас
Присоединяйтесь к команде ITRex и станьте ключевым экспертом по оптимизации нейросетей в международной AI-ориентированной компании!
Описание вакансии
AI Inference Engineer в ITRex
*📍*Польша
*💎*4 года работы, C++, ONNX Runtime, TensorRT / TensorRT-LLM, OpenVINO, MLC LLM, ExecuTorch, TVM
*🚀*В компании работает много русскоговорящих ребят
ITRex — AI/ML-ориентированная продуктово-инжиниринговая компания.
Размер команды — 201-500
Узнать подробнее и откликнуться: Откликнуться
Создайте идеальное резюме с помощью ИИ-агента

Навыки
- C++
- Machine Learning
- AI
- ONNX Runtime
- TensorRT
- TensorRT-LLM
- TVM
- OpenVINO
- ExecuTorch
- MLC-LLM
Возможные вопросы на собеседовании
Проверка понимания специфики работы с тензорными ядрами и оптимизации под конкретное железо NVIDIA.
Расскажите о вашем опыте оптимизации LLM с использованием TensorRT-LLM: какие техники квантования вы применяли и как это повлияло на latency?
Важно понять, умеет ли кандидат выбирать правильный инструмент под задачу (CPU vs GPU vs Edge).
В каких случаях вы предпочтете использовать OpenVINO вместо ONNX Runtime, и наоборот? Приведите примеры из практики.
Проверка навыков работы с мобильными и встраиваемыми устройствами.
Каков ваш опыт работы с ExecuTorch? С какими основными трудностями вы сталкивались при деплое моделей на мобильные платформы?
Оценка навыков написания производительного кода.
Какие паттерны C++ наиболее критичны для обеспечения минимального оверхеда при написании оберток для инференс-движков?
Проверка знаний в области компиляторов глубокого обучения.
Как работает TVM Relay и в чем преимущество использования TVM по сравнению с нативными библиотеками вендоров?
Похожие вакансии
Senior / Middle AI Engineer (Computer Vision)
AI-разработчик Senior
AI-разработчик (.NET + LLM)
AI-product engineer
Head of AI
AI-креатор (генерация видео и монтаж)
1000+ офферов получено
Устали искать работу? Мы найдём её за вас
Quick Offer улучшит ваше резюме, подберёт лучшие вакансии и откликнется за вас. Результат — в 3 раза больше приглашений на собеседования и никакой рутины!