aijobs.net

大模型算法工程师(开放域对话)

上海、北京

CNY 25K-37K (estimate) Entry-level Internship

Apply Save
Found 2h ago
Tasks
Perks/Benefits
Skills/Tech-stack

A/B | A/B Testing | AI Feedback | Agentic RL | B testing | DPO | DeepSpeed | Dialogue State Tracking | Distributed Training | Fine Tuning | Function Calling | GRPO | Human Feedback | Inference acceleration | Knowledge Distillation | Language Models | Large Language Models | Learning from Human Feedback | OpenRLHF | PPO | Prompt engineering | Python | Quantization | React | Reinforcement Learning | Reinforcement Learning from AI Feedback | Reinforcement Learning from Human Feedback | Reward Modeling | State tracking | Supervised Fine Tuning | Tool use | VLLM

Education

Bachelor of Engineering | Bachelor of Science | Master of Science

Roles

AI | AI Engineer | Engineer | Learning Engineer | Machine Learning Engineer | NLP Engineer

Regions

Asia/Pacific

Countries

China

States

Shanghai, CN | Beijing, CN

Cities

Shanghai, Shanghai, CN | Beijing, Beijing, CN

Apply Save
Language: zh Views: 1 Clicks: 0 Saves: 0

Related jobs