aijobs.net

AI Research Scientist, Reinforcement Learning (LLM) and Post-Training

US,CA,Santa Clara

USD 100K-150K (estimate) Mid-level Full Time

Apply Save
Found 1d ago
Tasks
Perks/Benefits
Skills/Tech-stack

Distributed Training | Experiment design | GPU Acceleration | Language Models | Large Language Models | Off Policy | Off Policy Learning | On Policy | On Policy Learning | Policy Optimization | Policy learning | Preference Learning | RLAIF | RLHF | Reinforcement Learning | Reward Hacking | Reward Hacking Mitigation | Reward Modeling | Variance reduction

Education

PhD

Roles

AI | AI Research Scientist | Engineer | Learning Engineer | Machine Learning Engineer | Research Scientist | Scientist

Regions

North America

Countries

Cuba

States

Villa Clara Province, CU

Cities

Santa Clara, Villa Clara Province, CU

Apply Save
Language: en Views: 2 Clicks: 1 Saves: 0

Related jobs