Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.
HireHi ищет инженера ML для оптимизации инференса больших языковых моделей и развития распределённой инфраструктуры с несколькими GPU. Требуется опыт работы с SGLang, vLLM или TensorRT-LLM и владение PyTorch/Transformers. Работа предполагает обучение, дообучение и развитие агентных архитектур в команде NLP/CV.
Ожидается знание распределённого обучения, QoS-инфа, KV кэш и квантование. Условия — высокий уровень вознаграждения и перспектива роста до Head of ML в США.
Платформа предназначена для персонализированного общения с AI-персонажами. Компания дообучает модели с открытым исходным кодом и работает с LLM до 1T параметров.