aijobs.net

Research Scientist / Engineer – Reinforcement Learning Infrastructure

SF Bay Area, CA, Remote, US, Remote, International, London, UK R

USD 200K-300K (estimate) Senior-level Full Time

Apply Save
Found 7h ago
Tasks
Perks/Benefits
Skills/Tech-stack

Asynchronous training | Containerization | Curriculum learning | Distributed Systems | Distributed Training | FSDP | GPU Cluster | Human Feedback | KV cache | Kubernetes | LLM Evaluation | Language Models | Large Language Models | Learning from Human Feedback | MPI | Mixture of Experts | Model Synchronization | NCCL | Off Policy | Off Policy Learning | Pipeline parallelism | Policy Optimization | Policy learning | Proximal Policy Optimization | PyTorch | Ray | Reinforcement Learning | Reinforcement Learning from Human Feedback | Reward Hacking | Reward Modeling | SGLang | Sandboxing | Sequence Packing | Tensor Parallelism | Tool use | VLLM

Education

N/A

Roles

Engineer | Learning Engineer | Machine Learning Engineer | Research Scientist | Scientist | Software Engineer

Regions

North America

Countries

United States

States

Ohio, US | California, US

Cities

London, Ohio, US

Apply Save
Language: en Views: 0 Clicks: 0 Saves: 0

Related jobs