Find jobs in AI/ML, Data Science and Big Data
11 results
for Preference Learning
(Skill/Tech stack)
-
大语言模型后训练/Agentic算法工程师 CNY 180K-360KAgentic RL | DAPO | Distributed Training | Evaluation Frameworks | Function CallingEntry-level Full Time上海、北京2h ago
-
Distributed Training | Experiment design | GPU Acceleration | Language Models | Large Language ModelsMid-level Full TimeUS,CA,Santa Clara6d ago
-
Data Generation | Data Processing | DeepSpeed | Direct Preference Optimization | Distributed TrainingEntry-level Full TimeSan Jose, California, United States16d ago
-
DPO | DeepSpeed | Distributed Training | Evaluation Pipelines | Human preference learningEntry-level Full TimeSan Jose, California, United States18d ago
-
Senior Computer Scientist USD 228K-331KAWS | Azure | Context Management | Data Pipelines | Language ModelsSenior-level Full TimeSan Jose, United States R21d ago
-
Content Classification | DPO | Data Generation | Data Processing | DeepSpeedDevelopment workshops | Hands-on experience | Industry exposure | Learning programs | Social eventsEntry-level InternshipSan Jose, California, United States25d ago
-
Entry-level Full TimeBeijing26d ago
-
Research Engineer / Scientist, Post-Training USD 295K-445KCatastrophic Forgetting | Data Mixtures | Deep learning | Experiment design | Fine TuningIn person work schedule | Open research publishing | Paid in person work trialMid-level Full TimeSan Francisco Office1mo ago
-
Airflow | Amazon SageMaker | Apache Beam | Argo Workflows | Attention MechanismsSenior-level Full TimeTel Aviv/ Hybrid (Israel), Israel R1mo ago
-
Entry-level Full Time上海1mo ago
-
Applied Reinforcement Learning Engineer USD 150K-300KA2C | A3C | Actor-critic | Agent systems | BCQCollaborate with industry leaders | Equal opportunity employer | Hybrid remote work | Research publications supportMid-level Full TimeRemote Work( USA), United States R1mo ago