Find jobs in AI/ML, Data Science and Big Data
19 results
for GRPO
(Skill/Tech stack)
-
大模型算法工程师 CNY 500K-500KAgent systems | Agentic Systems | Deep learning | Fine Tuning | Function CallingEntry-level Full Time北京1d ago
-
AI Lead Software Architect - SME USD 131K-218KAsynchronous programming | Autogen | C# | CI/CD | CUDASenior-level Full TimeChantilly/Herndon, VA1d ago
-
AI Research Scientist (Remote) USD 140K-215KAI Feedback | Agent architectures | Artificial Intelligence | Context Management | Cybersecurity threat researchCompetitive vacation and holidays | Employee networks | Great Place to Work certified | Paid adoption leave | Paid parental leaveSenior-level Full TimeUSA CA Remote, United States R5d ago
-
Senior Machine Learning Engineer USD 188K-282KAB Testing | Adversarial Machine Learning | Calibration monitoring | Canary Releases | Closed LoopSenior-level Full TimePalo Alto, CA8d ago
-
DPO | Efficient Model Design | Fine Tuning | GRPO | Generative AIEntry-level Full TimeSeattle, Washington, United States11d ago
-
Entry-level Full TimeBeijing13d ago
-
Machine Learning Engineer - Voice Conversion USD 200K-220KAdversarial Training | Audio CODEC | Audio Variational Autoencoder | Bias Testing | CUDA401k retirement plan | Company equity | Fertility support | Lifestyle spending account | Meals and snacksSenior-level Full TimeRemote (U.S. or Europe) R14d ago
-
DPO | Fine Tuning | GRPO | KV cache | LoRAHealth insurance | Remote work flexibility | Startup equitySenior-level Full TimeSingapore14d ago
-
Senior ML Engineer USD 153K-175KA/B | A/B Testing | AWQ | Attention Mechanisms | Axolotl401k retirement plan | Cell phone reimbursement | Company paid life insurance | Dental insurance | Employee assistance programSenior-level Full TimeDania Beach, United States22d ago
-
机器人真机强化学习算法实习生 CNY 25K-37KActor-critic | Data Analysis | GRPO | Multimodal Learning | Offline Reinforcement LearningEntry-level Internship上海25d ago
-
AI Feedback | Ablation Studies | Autolabeling | Chain-of-Thought | DPOBonus | Company benefits program | Equity | Health and wellness benefitsSenior-level Full TimeMountain View, California, United States26d ago
-
Data Scientist - Agentic AI Systems - IFS Loops USD 140K-150KAutogen | DPO | Deep learning | Embeddings | Evaluation401k company match | Disability benefits | Flexible paid time off | Flexible spending accounts | Life insuranceMid-level Full TimePalo Alto, California, United States1mo ago
-
Foundation AI Engineer (LLM) CAD 100K-110KAI Feedback | Attention Mechanisms | Constitutional AI | Constitutional Safety Tuning | Data CurationAnnual health checkups | Healthcare insurance | Opportunity to collaborate with industry professionals | Performance bonuses | Preferential pricing for servicesMid-level Full TimeHanoi, Vietnam1mo ago
-
Senior AI scientist INR 3715K-5449KALiBi | Adafactor Optimizer | AdamW | Attention Mechanisms | BF16Senior-level Full TimeRemote - India R1mo ago
-
Machine Learning Engineer, Proactive USD 170K-300KDPO | Deep learning | Efficient Fine Tuning | Factuality Evaluation | Fine TuningSenior-level Full TimeCupertino1mo ago
-
Applied Reinforcement Learning Engineer USD 150K-300KA2C | A3C | Actor-critic | Agent systems | BCQCollaborate with industry leaders | Equal opportunity employer | Hybrid remote work | Research publications supportMid-level Full TimeRemote Work( USA), United States R1mo ago
-
Senior AI Scientist USD 123K-197KALiBi | Adafactor | AdamW | Attention | BF16Annual bonus opportunity | Company RRSP contribution | Equity awards | Hybrid work | Insurance coverageSenior-level Full TimeRemote - USA, United States R1mo ago
-
Software Dev Engineer II, Stores Foundational AI -SFAI USD 143K-194KAsync Rollouts | Batching | C++ | CUDA | Data Delivery401k matching | Health insurance | Paid time off | Parental leaveMid-level Full TimeSeattle, Washington, USA1mo ago
-
Director, Reinforcement Learning & Agentic Post-Training EUR 151K-200KAI Feedback | API Integration | Distributed Training | Environment Design | EvaluationExecutive-level Full TimeParis, France1mo ago