Find jobs in AI/ML, Data Science and Big Data
3 results
for On policy Distillation
(Skill/Tech stack)
-
Senior Applied Scientist, Reinforcement Learning USD 189K-250KAgent automation | Human Feedback | LLM Training | LLM-as-judge | Language ProcessingSenior-level Full TimeMenlo Park, CA11h ago
-
Staff Applied Scientist, Reinforcement Learning USD 190K-270KLLM Training | LLM-as-judge | Language Models | Language Processing | Large Language ModelsSenior-level Full TimeMenlo Park, CA11h ago
-
大语言模型后训练/Agentic算法工程师 CNY 180K-360KDistributed Training | Function Calling | Java | Language Models | Language ProcessingEntry-level Full Time上海、北京22d ago