Tech Lead NLP Engineer
Что предстоит делать
Tech Lead NLP Engineer | LLM Inference | Remote
Возглавьте техническое развитие NLP в AI‑продукте, где большие языковые модели уже работают в production. Компания развивает платформу для персонализированного общения с AI‑персонажами, дообучает open‑source модели и работает с LLM до 1T параметров.
Чем интересна роль
• Около 70 % времени – hands‑on engineering, без Project/People Management
• Оптимизация скорости, стоимости и стабильности inference больших LLM
• Distributed inference на multi‑GPU / multi‑node инфраструктуре: 32×H200 + AWS
• Training и post‑training LLM, развитие agent architectures
• Техническое лидерство NLP/CV‑команды и перспектива роста до Head of ML
• Сильная команда, высокое вознаграждение, удаленно
Роль для вас, если
• Есть production‑опыт оптимизации LLM inference: SGLang / vLLM / TensorRT‑LLM
• Работали с distributed inference/training больших моделей: MoE, tensor/expert/pipeline parallelism, multi‑node GPU
• Сильны в KV cache, attention kernels, batching, quantization, GPU profiling
• Есть опыт training/fine‑tuning и post‑training: RLHF, DPO или аналоги
• Уверенно работаете с PyTorch / Transformers
• English В2+
Полное описание: https://itcharm.com/vacancies/f498e263-0bdb-4158-bedc-5908323077e3
Отклик и вопросы @alesyaly
Что мы ждём от кандидата
- Есть production‑опыт оптимизации LLM inference: SGLang / vLLM / TensorRT‑LLM
- Работали с distributed inference/training больших моделей: MoE, tensor/expert/pipeline parallelism, multi‑node GPU
- Сильны в KV cache, attention kernels, batching, quantization, GPU profiling
- Есть опыт training/fine‑tuning и post‑training: RLHF, DPO или аналоги
- Уверенно работаете с PyTorch / Transformers
- English В2+
Что предлагаем
- Полностью удаленная работа
- Высокое вознаграждение
О Deffic
Откликнитесь на сайте работодателя.