Find jobs in AI/ML, Data Science and Big Data
15 results
for Offline Reinforcement Learning
(Skill/Tech stack)
-
机器人真机强化学习算法实习生 CNY 25K-37KActor-critic | Data Analysis | GRPO | Multimodal Learning | Offline Reinforcement LearningEntry-level Internship上海3d ago
-
Machine Learning Engineer – RL USD 155K-180KActor-critic | Adversarial Testing | Conservative Policies | Constraint Enforcement | DPOSenior-level Full TimeUnited States - Remote R4d ago
-
Senior AI Engineer (Closed-loop Simulation & RL) KRW 30000K-30000K3DGS | Agent simulation | Autonomous Driving | CARLA | Counterfactual SimulationSenior-level Full TimePangyo (Software Dream Center), South Korea7d ago
-
[MS/PhD Intern] AI Engineer (정규직 전환형) KRW 25284K-25754KAblation Studies | Auto-labeling | Autonomous Driving | Benchmarking | Critical SystemsEntry-level InternshipPangyo (Software Dream Center), South Korea7d ago
-
Entry-level Full Time上海12d ago
-
全身运控操作研究员 CNY 180K-360KContact modeling | Diffusion Models | Dynamic stability | Imitation Learning | Isaac SimAcademic publishing support | High level research environment | Research platform support | Team collaboration with hardware and control expertsMid-level Full Time北京、上海14d ago
-
Sr. Data Scientist II (Remote Eligible) USD 155K-185KBatch Processing | Causal Inference | Contextual Bandits | Data Pipelines | Databricks401k match | Employer subsidized medical dental and vision | Flexible time off | Life insurance | Long-term disabilityMid-level Full Time-REMOTE, USA- R16d ago
-
Applied Reinforcement Learning Engineer USD 150K-300KA2C | A3C | Actor-critic | Agent systems | BCQCollaborate with industry leaders | Equal opportunity employer | Hybrid remote work | Research publications supportMid-level Full TimeRemote Work( USA), United States R19d ago
-
Software Engineer Sys 5 USD 141K-307KAI monitoring | Access Control | Agent Orchestration | Anthropic | Audit LoggingSenior-level Full TimeUS-CA-Fremont (1003)21d ago
-
Director, Reinforcement Learning & Agentic Post-Training EUR 151K-200KAI Feedback | API Integration | Distributed Training | Environment Design | EvaluationExecutive-level Full TimeParis, France1mo ago
-
Bandit Algorithms | Data Analysis | Deep learning | Generative AI | Language ModelsCareer growth opportunities | Hands-on project experience | Research mentorshipEntry-level InternshipSan Jose, California, United States1mo ago
-
Sr Principal Data Scientist INR 3000K-4000KAgentic AI | Causal Inference | Causal ML | Contextual Bandits | DatabricksSenior-level Full TimeBangalore, INDIA R1mo ago
-
Sr. Physical AI Research Scientist CAD 140K-180KAI alignment | Artificial Intelligence | Computer Vision | Constitutional AI | Continual LearningHybrid work scheduleSenior-level Full TimeToronto, ON, CA1mo ago
-
具身智能-强化学习(灵巧操作方向) 实习生 CNY 25K-37KActor-critic | Diffusion Models | Distributed Training | Embodied intelligence | Flow matchingEntry-level Full Time Internship深圳1mo ago
-
Machine Learning Engineer - Reinforcement Learning USD 150K-250KData Processing | Deep learning | Distributed Training | Evaluation metrics | Generative ModelsDental insurance | Family leave | Free food and snacks | Health insurance | Life insuranceSenior-level Full TimeFremont, California, United States1mo ago