Find jobs in AI/ML, Data Science and Big Data
17 results
for Human evaluation
(Skill/Tech stack)
-
Product Content Engineer GBP 55K-90KA/B | A/B Testing | AI Evaluation | B testing | Bias MitigationSenior-level Full TimeLondon, UK3d ago
-
Applied AI Developer SGD 162K-225KAgent Orchestration | BTP | CAP | HANA Cloud | Human evaluationContinuous learning | Flexible working models | Health and wellbeing | Skill growthSenior-level Full TimeSingapore, SG, 1174403d ago
-
Foundation Model Engineer USD 200K-230KCluster operations | DPO | Distributed Training | Evaluation methodology | FSDPSenior-level Full TimeUnited States - Remote R3d ago
-
Large Language Model Specialist USD 100K-150KAdapter-Tuning | Benchmarking | DPO | Dataset Distillation | Dataset curationSenior-level Full TimePhoenix — Ahwatukee, AZ R4d ago
-
LLM Engineer USD 100K-150KAdapter | Automated benchmarking | DPO | Distributed Training | EvaluationSenior-level Full TimeUnited States - Remote R4d ago
-
Benchmarking | Computer Vision | Databricks | Deep learning | Diffusion ModelsSenior-level Full TimeBay Area - Hybrid R5d ago
-
Agents | Benchmarking | Computer Vision | Databricks | DistillationSenior-level Full TimeRemote - No Preference R5d ago
-
LLM Engineer USD 72K-100KDPO | Data Generation | Dataset Construction | Dataset Distillation | Deep learningCareer growth potential | Remote workMid-level Full TimeUnited States - Remote R7d ago
-
Product Evaluations Lead - Gen AI Software USD 224K-356KA/B | A/B Testing | Agentic AI | B testing | BenchmarkingSenior-level Full TimeUS, CA, Santa Clara7d ago
-
Benchmarking | Code review | Debugging | Evaluation | Generative AISenior-level Full TimeCupertino10d ago
-
A/B | A/B Testing | AWS | Adversarial Testing | AgentsSenior-level Full TimeRemote - IA, United States R11d ago
-
Senior Applied Scientist, Multilingual AI Evaluation USD 166K-293KBenchmark design | Bias and fairness | Bias and fairness evaluation | Cross-lingual modeling | Dataset designSenior-level Full TimeSeattle12d ago
-
Computational Linguist, AI Evaluation USD 140K-160KAWS EC2 | AWS S3 | Analytics | Automated scoring | BenchmarkingCo-working memberships | Daily meals provided | Flexible PTO | Health, dental, vision benefits | Learning and development stipendSenior-level Full TimeSan Francisco25d ago
-
Lead AI Engineer – Agentic & Generative AI (DFW Area) USD 122K-208KAWS | Agent systems | Azure | Bias/fairness | CI/CDHybrid work schedule | In office 2 to 3 days per weekSenior-level Full TimeRichardson, TX, United States28d ago
-
Ablation Studies | Audio Modeling | Benchmarking | Computational Linguistics | Deep learningMid-level Full TimeParis1mo ago
-
Sr. SW Engineer, Machine Learning INR 2475K-3465KA/B | A/B Testing | Agent systems | B testing | CI/CDFinancial wellness support | Hybrid work | Mental health support | Time offSenior-level Full TimeBengaluru, India1mo ago
-
Research Scientist, LLM Evaluation & Post-Training USD 150K-300KAI Feedback | Alignment | Benchmarking | Context evaluation | Deep learningMid-level Full TimeRemote Work( USA), United States R1mo ago