Find jobs in AI/ML, Data Science and Big Data
48 results
for Preference optimization
(Skill/Tech stack)
-
Member of Technical Staff - AI/ML Engineer INR 2500K-4500KAnomaly Detection | BM25 | Computer Vision | Document Understanding | Entity ResolutionEquity | Professional developmentSenior-level Full TimeHyderabad, TS, IN17h ago
-
Digital & GenAI Analyst - Consulting INR 2500K-5000KAgent systems | Agentic Systems | Benchmarking | Deep learning | Direct Preference OptimizationSenior-level Full TimeIndia1d ago
-
Senior-level Full TimeUnited States - Remote R1d ago
-
Large Language Model Specialist USD 100K-150KAdapter | Attention | Benchmarking | DPO | Data CurationSenior-level Full TimeTempe, AZ R1d ago
-
LLM Engineer USD 100K-150KAdapter modules | Attention Optimization | Benchmarking | DPO | Dataset DistillationSenior-level Full TimeUnited States - Remote R1d ago
-
Foundation Model Engineer USD 100K-150KAdapter Layers | DPO | Dataset curation | DeepSpeed ZeRO | Distributed TrainingSenior-level Full TimeUnited States - Remote R1d ago
-
Generative AI Engineer USD 100K-150KAdapter-Tuning | Benchmarking | DPO | Direct Preference Optimization | Distributed TrainingSenior-level Full TimeUnited States - Remote R4d ago
-
Large Language Model Specialist USD 100K-150KAdapter methods | Attention Optimization | DPO | Evaluation methodology | FSDPSenior-level Full Time85295, AZ R4d ago
-
AWS | Agentic Workflows | Azure | CI/CD | CheminformaticsHealth care coverage | In-house training courses | Paid time off | Recognition programs | Retirement savings planMid-level Full TimePrinceton (NJ), United States4d ago
-
Senior-level Full TimeTel Aviv/ Hybrid (Israel), Israel R5d ago
-
Foundation Model Engineer USD 100K-150KAdapter methods | Attention Mechanisms | Dataset curation | Direct Preference Optimization | Distributed TrainingSenior-level Full TimeUnited States - Remote R5d ago
-
Foundation AI Engineer (LLM) CAD 100K-110KAI Feedback | Attention Mechanisms | Constitutional AI | Constitutional Safety Tuning | Data CurationAnnual health checkups | Healthcare insurance | Opportunity to collaborate with industry professionals | Performance bonuses | Preferential pricing for servicesMid-level Full TimeHanoi, Vietnam5d ago
-
Agentic AI Engineer (LLM) USD 106K-181KA/B | A/B Testing | API Development | Agent Orchestration | AutogenAnnual health check-ups | Opportunity to collaborate and learn from industry professionals | Performance bonuses | Preferential pricing for services | Premium healthcare packageMid-level Full TimeHanoi, Vietnam5d ago
-
Amazon Web Services | C++ | Cloud platform | Dask | Data GenerationSenior-level Full TimeAachen6d ago
-
Ablation Studies | Active Learning | Adversarial Testing | Attention Mechanisms | BPEFlexible work arrangements | Fully remote | Inclusive collaborative environment | Professional growthMid-level Full TimeBrazil R7d ago
-
CI/CD | ClearML | Containerization | Continuous integration | Curriculum learningFlexible work arrangement | Hybrid work model | Learning opportunities | On-the-job coaching | Work-life balanceMid-level Full TimeUnited Kingdom, London R7d ago
-
Machine Learning Research Engineer | Kilby Labs USD 137K-238KC# | C++ | Deep learning | Direct Preference Optimization | EmbeddingsCareer development | Employee wellbeingMid-level Full TimeUnited States7d ago
-
AI Agents Applied Research/Engineering Lead - Executive Director INR 2500K-5000KA/B | A/B Testing | Adversarial Testing | Agent Orchestration | AuditabilityDiversity and inclusion | Publication opportunities | Research deployment to productionSenior-level Full TimeBengaluru, Karnataka, India11d ago
-
Machine Learning Engineer, Proactive USD 170K-300KDPO | Deep learning | Efficient Fine Tuning | Factuality Evaluation | Fine TuningSenior-level Full TimeCupertino12d ago
-
Senior AI Engineer - Fury Team USD 200K-400KAgent coordination | Benchmarking | Data Curation | Deep learning | Direct Preference OptimizationCatered lunch daily | Company holidays | EV charging | Equity | Fully stocked kitchenSenior-level Full TimeRemote R12d ago
-
LLM Engineer USD 100K-150KAdapters | Attention Optimization | DPO | Dataset curation | Evaluation methodologyMid-level Full TimeUnited States - Remote R13d ago
-
Applied Reinforcement Learning Engineer USD 150K-300KA2C | A3C | Actor-critic | Agent systems | BCQCollaborate with industry leaders | Equal opportunity employer | Hybrid remote work | Research publications supportMid-level Full TimeRemote Work( USA), United States R13d ago
-
AWS | Azure | Benchmarking | Containerization | Direct Preference OptimizationCustomer facing technical work | Remote workSenior-level Full TimeSan Mateo, California, United States R13d ago
-
Mid-level Full TimeTel Aviv-Yafo, Tel Aviv District, IL14d ago
-
Airflow | Apache Spark | Data Curation | Data Filtering | Data evaluationSenior-level Full TimePangyo (Software Dream Center), South Korea18d ago
-
Data Analysis | Direct Preference Optimization | Fine Tuning | LLM safety | Language ModelsBonus target | Equity | Health insurance | Paid time off | Retirement plansSenior-level Full TimeSunnyvale, CA, USA18d ago
-
Senior-level Full TimeIND, Remote R19d ago
-
Senior AI Engineer - LLMs and Finetuning GBP 84K-109KAWS | Benchmarking | Data Generation | Dataset Engineering | Distributed TrainingEnhanced parental leave | Flexible working arrangements | Group life assurance | Hybrid working | Paid sabbaticalSenior-level Full TimeLondon20d ago
-
AI Feedback | Checkpointing | Cost Performance | Cost-performance tradeoffs | Data Decontamination401k matching | Country specific visa support | Flexible work arrangements | Medical, dental, and vision options | Parental leaveSenior-level Full TimePalo Alto, California, United States21d ago
-
Senior AI/ML engineer GBP 120K-150KAWS | CI/CD | Databricks | Deep learning | Delta LakeAccelerated professional growth | Enhanced parental leave | Female health leave | Fully paid sabbatical | Health pension wellbeing benefitsSenior-level Full TimeLondon R24d ago
-
Junior Foundation AI Engineer EUR 30KAWS | Accelerate | Azure | CUDA | Cloud ComputingCorporate welfare | Health insurance | Meal vouchers | Smart working | TrainingEntry-level Full TimeMilano (Bassi), Italy26d ago
-
Staff Software Engineer, AI/ML USD 216K-271KAI Feedback | Agentic AI | Data Pipelines | Direct Preference Optimization | Experimentation platformsConference reimbursement | Education reimbursement | Employee assistance program | Employee stock purchase program | Equity compensationSenior-level Full TimeSeattle27d ago
-
Senior Solutions Architect, Generative AI Research USD 184K-287KAI Agents | AI Feedback | Agent evaluation | Artificial Intelligence | BatchingSenior-level Full TimeUS, FL, Remote, United States R27d ago
-
Senior Applied Scientist USD 142K-270KData Pipelines | Diffusion Models | Direct Preference Optimization | Evaluation metrics | Fine TuningSenior-level Full TimeSeattle, United States R27d ago
-
Director, Reinforcement Learning & Agentic Post-Training EUR 151K-200KAI Feedback | API Integration | Distributed Training | Environment Design | EvaluationExecutive-level Full TimeParis, France27d ago
-
Senior Applied Scientist, Alexa AI USD 167K-227KAgentic Architectures | Automated Training | Automated training pipelines | C++ | DPOSenior-level Full TimeTurin, Piedmont, ITA29d ago
-
Senior Software Engineer - Model Training & AI Evals INR 3500K-5000KAI Feedback | Ablation Studies | Benchmarking | CI/CD | Data GenerationSenior-level Full TimeRemote (India) R1mo ago
-
Staff AI research scientist USD 234K-296KAdversarial Training | Agentic Systems | Benchmark design | Data Curation | Data GenerationCompany holidays | Company offsites | Dental insurance | Dependent FSA | Fertility supportSenior-level Full TimeSan Francisco, CA1mo ago
-
Director, Applied Science, Alexa for Shopping (Rufus) USD 262K-350KAgent systems | Deep Deterministic Policy Gradient | Direct Preference Optimization | Distillation | Experimentation401k matching | Dental insurance | Employee assistance program | Health insurance | Mental health supportExecutive-level Full TimeSeattle, Washington, USA1mo ago
-
Senior Machine Learning Engineer USD 188K-282KAdversarial Training | Calibration monitoring | Continuous batching | DPO | Deep learningSenior-level Full TimePalo Alto, CA1mo ago
-
Staff/Senior AI Engineer, AI for Code GBP 81K-115KAgentic Workflows | Benchmarking | Context engineering | Cost Optimization | Fine TuningExtra time off | Flexible work location | Internal events | Language classes | Learning and development opportunitiesSenior-level Full TimeAmsterdam, Netherlands; Belgrade, Serbia; Berlin, Germany; … R1mo ago
-
Research Scientist, LLM Evaluation & Post-Training USD 150K-300KAI Feedback | Alignment | Benchmarking | Context evaluation | Deep learningMid-level Full TimeRemote Work( USA), United States R1mo ago
-
Research Engineer - LLM Training & Alignment Systems CAD 127K-225KAutomation | Benchmarking | C# | C++ | Data CurationMid-level Contract Full TimeKingston, Ontario, Canada1mo ago
-
Senior Machine Learning Engineer , AI Platform USD 150K-210KArtificial Intelligence | Batch Processing | Data Analysis | Data Pipelines | Data PrivacySenior-level Full TimeBoston, MA1mo ago
-
Sr. Data Scientist INR 2500K-3380KApache Spark | Deep learning | Drift Detection | Evaluation | Experimentation platformsSenior-level Full TimeBangalore,India1mo ago
-
AI Feedback | Agentic Systems | Direct Preference Optimization | Distributed Training | EvaluationSenior-level Full TimeAMER - United States - California … R1mo ago
-
Senior Applied Scientist USD 142K-270KAI Model Training | AI model | Fine Tuning | Generative AI | Inference OptimizationSenior-level Full TimeSan Jose, United States R1mo ago
-
Data Curation | Deep learning | DeepSpeed | Direct Preference Optimization | EvaluationSenior-level Full TimeSingapore, Singapore1mo ago