Tech Lead NLP Engineer | LLM Inference | Remote
Возглавьте техническое развитие NLP в AI-продукте, где большие языковые модели уже работают в production. Компания развивает платформу для персонализированного общения с AI-персонажами, дообучает open-source модели и работает с LLM до 1T параметров.
Чем интересна роль
- Около 70% времени - hands-on engineering, без Project/People Management
- Оптимизация скорости, стоимости и стабильности inference больших LLM
- Distributed inference на multi-GPU / multi-node инфраструктуре: 32×H200 + AWS
- Training и post-training LLM, развитие agent architectures
- Техническое лидерство NLP/CV-команды и перспектива роста до Head of ML
- Сильная команда, высокое вознаграждение, удаленно
Роль для вас, если
- Есть production-опыт оптимизации LLM inference: SGLang / vLLM / TensorRT-LLM
- Работали с distributed inference/training больших моделей: MoE, tensor/expert/pipeline parallelism, multi-node GPU
- Сильны в KV cache, attention kernels, batching, quantization, GPU profiling
- Есть опыт training/fine-tuning и post-training: RLHF, DPO или аналоги
- Уверенно работаете с PyTorch / Transformers
- English В2+
Полное описание https://itcharm.com/vacancies/f498e263-0bdb-4158-bedc-5908323077e3
Отклик и вопросы @alesyaly
CONTACTS:
- https://itcharm.com/vacancies/f498e263-0bdb-4158-bedc-5908323077e3
- @alesyaly
Похожие вакансии Remote Job