Find jobs in AI/ML, Data Science and Big Data
14 results
for Offline Reinforcement Learning
(Skill/Tech stack)
-
AI Research Engineer USD 200K-400KAgent systems | Constrained decoding | Data Curation | Evaluation Harness | Hugging FaceMid-level Full TimeNew York City12d ago
-
Applied Scientist - Reinforcement learning, OMHS SCS USD 142K-193KActor-critic | C++ | Contextual Bandits | Decision Making | Deep reinforcement learning401k matching | Dental insurance | Employee assistance program mental health support | Flexible spending accounts | Health insuranceEntry-level Full TimeNorth Reading, Massachusetts, USA14d ago
-
全身运控操作研究员 CNY 144K-240KContact modeling | Control Theory | Dynamic stability | Imitation Learning | Isaac SimCollaborative research environment | Conference paper support | Open source contribution opportunities | Real robot platform access | Research funding supportMid-level Full Time北京、上海14d ago
-
Entry-level Full Time上海 R20d ago
-
机器人真机强化学习算法实习生 CNY 25K-37KActor-critic | Data Analysis | GRPO | Multimodal Learning | Offline Reinforcement LearningEntry-level Internship上海24d ago
-
Senior AI Engineer (Closed-loop Simulation & RL) KRW 30000K-30000K3DGS | Agent simulation | Autonomous Driving | CARLA | Counterfactual SimulationSenior-level Full TimePangyo (Software Dream Center), South Korea29d ago
-
[MS/PhD Intern] AI Engineer (정규직 전환형) KRW 25284K-25754KAblation Studies | Auto-labeling | Autonomous Driving | Benchmarking | Critical SystemsEntry-level InternshipPangyo (Software Dream Center), South Korea29d ago
-
Entry-level Full Time上海1mo ago
-
全身运控操作研究员 CNY 180K-360KContact modeling | Diffusion Models | Dynamic stability | Imitation Learning | Isaac SimAcademic publishing support | High level research environment | Research platform support | Team collaboration with hardware and control expertsMid-level Full Time北京、上海1mo ago
-
Sr. Data Scientist II (Remote Eligible) USD 155K-185KBatch Processing | Causal Inference | Contextual Bandits | Data Pipelines | Databricks401k match | Employer subsidized medical dental and vision | Flexible time off | Life insurance | Long-term disabilityMid-level Full Time-REMOTE, USA- R1mo ago
-
Applied Reinforcement Learning Engineer USD 150K-300KA2C | A3C | Actor-critic | Agent systems | BCQCollaborate with industry leaders | Equal opportunity employer | Hybrid remote work | Research publications supportMid-level Full TimeRemote Work( USA), United States R1mo ago
-
Software Engineer Sys 5 USD 141K-307KAI monitoring | Access Control | Agent Orchestration | Anthropic | Audit LoggingSenior-level Full TimeUS-CA-Fremont (1003)1mo ago
-
Director, Reinforcement Learning & Agentic Post-Training EUR 151K-200KAI Feedback | API Integration | Distributed Training | Environment Design | EvaluationExecutive-level Full TimeParis, France1mo ago
-
Bandit Algorithms | Data Analysis | Deep learning | Generative AI | Language ModelsCareer growth opportunities | Hands-on project experience | Research mentorshipEntry-level InternshipSan Jose, California, United States1mo ago