Find jobs in AI/ML, Data Science and Big Data
26 results
for PPO
(Skill/Tech stack)
-
Staff R&D AI Engineer USD 146K-175KAI Deployment | AWS | Attention Mechanisms | Azure | Computer Vision401k match | Continuing education support | Equity options | Flexible time off | Free parkingSenior-level Full TimeAustin, TX1d ago
-
Principal AI/ML Researcher USD 270K-300KArtificial Intelligence | Context Parallelism | DPO | Data parallelism | Deep learningEquity compensation | Health and wellness benefits | Relocation assistanceSenior-level Full TimeBoston, MA3d ago
-
Senior Machine Learning Engineer INR 4000K-7000KAdapters | Benchmarking | DORA | DPO | Dataset PreparationMid-level Full TimeNoida, Uttar Pradesh, India5d ago
-
Foundation AI Engineer (LLM) CAD 100K-110KAI Feedback | Attention Mechanisms | Constitutional AI | Constitutional Safety Tuning | Data CurationAnnual health checkups | Healthcare insurance | Opportunity to collaborate with industry professionals | Performance bonuses | Preferential pricing for servicesMid-level Full TimeHanoi, Vietnam5d ago
-
Entry-level Full Time北京 R6d ago
-
Ablation Studies | Active Learning | Adversarial Testing | Attention Mechanisms | BPEFlexible work arrangements | Fully remote | Inclusive collaborative environment | Professional growthMid-level Full TimeBrazil R7d ago
-
Data Scientist SGD 120K-190KActor-critic | Amazon S3 | Apache Airflow | Apache Spark | Attention MechanismsMid-level Full TimeSingapore - Suntec12d ago
-
Machine Learning Engineer, Proactive USD 170K-300KDPO | Deep learning | Efficient Fine Tuning | Factuality Evaluation | Fine TuningSenior-level Full TimeCupertino12d ago
-
Applied Reinforcement Learning Engineer USD 150K-300KA2C | A3C | Actor-critic | Agent systems | BCQCollaborate with industry leaders | Equal opportunity employer | Hybrid remote work | Research publications supportMid-level Full TimeRemote Work( USA), United States R13d ago
-
具身智能算法工程师 CNY 25K-37KDeep learning | Distributed Training | GPU Training | IQL | Inference OptimizationInternshipEntry-level Internship北京 R13d ago
-
Senior Research Scientist- Robotics AI USD 185K-215K3D Scene | 3D Scene Understanding | BEV Feature Representation | C++ | Computer Vision401k matching | Disability protection | Health coverage | Life insurance | Paid time offSenior-level Full TimeSunnyvale, CA, United States14d ago
-
大模型算法工程师(开放域对话) CNY 180K-300KData Deduplication | Data cleaning | DeepSpeed | Dialogue State Tracking | Distributed TrainingMid-level Internship上海、北京14d ago
-
大语言模型后训练/Agentic算法工程师 CNY 180K-360KDistributed Training | Function Calling | Java | Language Models | Language ProcessingEntry-level Full Time上海、北京14d ago
-
Behavior Cloning | C++ | Cloud processing | Control | DaggerEntry-level Internship北京、上海 R20d ago
-
Specialist Healthcare Enrollment USD 74K-108KACA Compliance | Charity Care | Data entry | Data interchange | EDI403b retirement plan options | Employee assistance program | Federal Student Loan Forgiveness | Health and wellness programs | Life insuranceMid-level Part TimePaterson, NJ, United States21d ago
-
Software Dev Engineer II, Stores Foundational AI -SFAI USD 165K-223KAsync Rollouts | Batching | C++ | CUDA | Cluster computing401k matching | Adoption reimbursement | Dental insurance | Employee assistance program | Flexible spending accountsMid-level Full TimePalo Alto, California, USA22d ago
-
Software Dev Engineer II, Stores Foundational AI -SFAI USD 143K-194KCUDA | Data Pipelines | Distributed Training | Dynamo | Experiment tracking401k matching | Employee assistance program | Health insurance | Paid time off | Parental leaveMid-level Full TimeSeattle, Washington, USA22d ago
-
Software Dev Engineer II, Stores Foundational AI -SFAI USD 143K-194KAsync Rollouts | Batching | C++ | CUDA | Data Delivery401k matching | Health insurance | Paid time off | Parental leaveMid-level Full TimeSeattle, Washington, USA22d ago
-
Director, Reinforcement Learning & Agentic Post-Training EUR 151K-200KAI Feedback | API Integration | Distributed Training | Environment Design | EvaluationExecutive-level Full TimeParis, France27d ago
-
Agent systems | DPO | Distributed Training | Fine Tuning | JAXEntry-level Full TimeUS-WA-Bellevue1mo ago
-
Research Scientist- Robotics AI USD 165K-185K3D Scene | 3D Scene Understanding | BEV | Behavior planning | C++401k matching | Financial planning support | Health insurance | Life and disability protection | Paid time offMid-level Full TimeSunnyvale, CA, United States1mo ago
-
Senior Research Scientist- Robotics AI USD 185K-215K3D Scene | 3D Scene Understanding | Autonomous Planning | BEV grid | Behavioral Planning401k matching | Disability insurance | Financial planning support | Health insurance | Life insuranceSenior-level Full TimeSunnyvale, CA, United States1mo ago
-
Research Engineer - LLM Training & Alignment Systems CAD 127K-225KAutomation | Benchmarking | C# | C++ | Data CurationMid-level Contract Full TimeKingston, Ontario, Canada1mo ago
-
Senior-level Full TimeSeoul, Korea1mo ago
-
Principal AI Research Scientist Post-Training Alignment CAD 123K-180KAgentic AI | Alignment research | DPO | Deep learning | Distributed TrainingSenior-level Full TimeAMER - Canada - Ontario - …1mo ago
-
Senior AI Researcher (Foundation AI) USD 190K-230KCI/CD | Cloud Computing | Context Parallelism | DPO | Data parallelismSenior-level Full TimeBoston, MA1mo ago