Lead ML Engineer — LLM Inference & NLP
Высокий балл за работу над open-source проектами мирового уровня, амбициозные задачи с моделями 1T+ и возможность удаленной работы. Проект Joi Lab выделяется на фоне типичных продуктовых компаний своим исследовательским подходом.
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.
Улучшите резюме под эту вакансию
Возьмём требования и создадим новую версию резюме с акцентом на нужный опыт
Сложность вакансии
Роль требует редкого сочетания глубоких знаний в области инференса сверхбольших моделей (1T+ параметров) и навыков технического руководства. Ожидается опыт работы с передовыми фреймворками оптимизации и распределенными системами.
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.
Анализ зарплаты
Для позиции Lead ML Engineer с фокусом на LLM Inference в международном проекте, рыночные зарплаты значительно выше средних по IT. Указанный диапазон соответствует топовым предложениям для специалистов с глубокой экспертизой в распределенных системах и оптимизации нейросетей.
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.
Описание вакансии
Lead ML Engineer — LLM Inference & NLP / Joi AI
Remote
Joi Lab (joilab.ai) is our open research arm — we build open-source generative models, agent architectures, and training infrastructure. All code, weights, and data are public. We're not chasing the next ChatGPT wrapper; we're working on true AI agency: persistent memory, self-modification, self-authored.
You make huge models, up to 1T+ parameters, answer fast and cheap in production. SGLang, caching, distributed inference, post-training. You also set the technical direction for our NLP and CV engineers.
Требования к кандидату:
- 5+ years of experience in ML engineering
- Deep hands-on experience optimizing LLM inference
- Proficiency with PyTorch and related libraries
- Experience with distributed inference/training of large models
- Strong understanding of inference optimization techniques
- Proven technical leadership in guiding engineers
- Backend engineering experience (Python, Go, C#)
- Advanced English or Russian language skills
Читать подробнее:
Больше похожих вакансий + автоотклики с ИИ
Умный подбор, сопроводительные письма, советы по отказам — больше приглашений.

Навыки
- LLM
- NLP
- PyTorch
- Python
- Go
- C#
- Distributed Systems
- Machine Learning
- SGLang
- Computer Vision
Возможные вопросы на собеседовании
Проверка практического опыта работы с инструментами, упомянутыми в вакансии.
Расскажите о вашем опыте использования SGLang или аналогичных библиотек для оптимизации пропускной способности LLM. Каких результатов удалось достичь?
Вакансия предполагает работу с моделями 1T+ параметров. Важно понять, как кандидат решает проблемы масштабирования.
С какими основными трудностями вы сталкивались при организации распределенного инференса для моделей, не помещающихся в память одного узла?
Ключевая задача — сделать инференс дешевым и быстрым.
Какие методы квантования или дистилляции вы считаете наиболее эффективными для сохранения качества ответов при значительном ускорении инференса?
Позиция уровня Lead подразумевает управление командой.
Как вы подходите к постановке технических задач для NLP и CV инженеров и контролю качества их кода в исследовательских проектах?
Компания работает над 'true AI agency'.
Каким вы видите архитектурное решение для реализации персистентной памяти в современных агентных системах?
Сформировано ИИ автоматически. Не является проверкой вакансии или работодателя.

