Find jobs in AI/ML, Data Science and Big Data
74 results
for Preference optimization
(Skill/Tech stack)
-
A/B | A/B Testing | B testing | C++ | Canary ReleaseNone Full TimeSeattle, Washington, United States1d ago
-
Data Processing | Deep learning | Distributed Training | Generative Models | LLMFamily leave | Free food and snacks | Health care plan | Life insurance | Long-term disabilitySenior-level Full Time费利蒙1d ago
-
Machine Learning Research Scientist, Post-Training USD 180K-225KDeep learning | Fine Tuning | Human Feedback | Instruction Tuning | Language ModelsCommuter stipend | Health, dental and vision coverage | Learning and development stipend | Paid time off | Retirement benefitsMid-level Full TimeSan Francisco, CA; Seattle, WA; New …3d ago
-
Airflow | Data Curation | Data Quality | Data Quality Evaluation | Deep learningMid-level Full TimePangyo (Software Dream Center), South Korea R4d ago
-
Research Scientist - Salesforce AI Research USD 117K-313KAI Reasoning | AI Reasoning and Planning | Agentic AI | Computer Vision | Deep learning401k | Dental insurance | Employee stock purchase program | Life and disability insurance | Medical insuranceEntry-level Full TimeCalifornia - Palo Alto, United States4d ago
-
Generative AI Engineer USD 90K-115KDPO | Data Generation | Dataset Distillation | DeepSpeed ZeRO | Distributed TrainingSenior-level Full TimeUnited States - Remote R4d ago
-
Senior ML Research Engineer/Scientist INR 3000K-4580KAgent collaboration | Agentic AI | Benchmark design | Context engineering | Data MixtureSenior-level Full TimeHyderabad, India R4d ago
-
Direct Preference Optimization | Evaluation Frameworks | Fine Tuning | Hallucination detection | Hugging FaceMid-level Full TimeSeattle4d ago
-
Senior Applied Scientist GBP 110K-135KAirflow | Apache Spark | Dagster | Databricks | Deep learningSenior-level Full TimeLondon5d ago
-
NLP AI Engineer USD 130K-180KData Generation | DeepSpeed ZeRO | Direct Preference Optimization | Distributed Training | DockerSenior-level Full TimeUnited States - Remote R6d ago
-
Co-op Researcher - LLMs & Computer Vision CAD 58K-104KAdversarial Networks | Agentic Workflows | Blender | Computer Vision | Deep learningEntry-level Full TimeMarkham, Ontario, Canada8d ago
-
DeepSpeed | Distributed Systems | Docker | FSDP | Fine TuningEntry-level Full TimeEdmonton, Alberta, Canada8d ago
-
Co-op Researcher - LLMs & Computer Vision CAD 58K-104KAdversarial Networks | Agentic Workflows | Blender | Computer Vision | Deep learningInclusive hiring processEntry-level Full TimeMarkham, Ontario, Canada8d ago
-
Research Engineer, Gemini Code Post-training, DeepMind USD 174K-252KBenchmarking | Data Curation | Data Generation | Distributed Training | Evaluation benchmarksMid-level Full TimeMountain View, CA, USA9d ago
-
Senior Deep Learning Scientist, Multimodal Agentic RL USD 184K-287KDataset versioning | Deep learning | Distributed Training | Experiment tracking | Instruction TuningSenior-level Full TimeUS, CA, Santa Clara R9d ago
-
Machine Learning Engineer Graduate (E-Commerce Supply Chain & Logistics - LLM/Agent) - 2027 Start (PhD) USD 137K-246KAI Feedback | Agents | Benchmarking | C++ | DPOEntry-level Full TimeSeattle, Washington, United States10d ago
-
Machine Learning Engineer Intern (E-Commerce Supply Chain & Logistics-LLM / Agent) - 2027 Start (PhD) USD 137K-246KBenchmarking | C++ | Context understanding | Direct Preference Optimization | Evidence GroundingEntry-level InternshipSeattle, Washington, United States10d ago
-
Senior ML Engineer (Europe-based/Remote) USD 159K-215KAgentic Workflows | Deep learning | Direct Preference Optimization | Distributed Systems | Evaluation datasetsSenior-level Full TimeEurope (Remote) R10d ago
-
Staff Gen AI Research Scientist USD 220K-292KComputer Vision | Deep learning | DeepSpeed | Direct Preference Optimization | Generative AISenior-level Full TimeCosta Mesa, California, United States; Seattle, …10d ago
-
Senior Director of Engineering, Generative AI USD 525K-573K3D Scene | 3D Scene Understanding | Agentic Systems | Artificial Intelligence | BenchmarkingEquity compensation | Health benefits | Onsite days Tuesday Wednesday ThursdaySenior-level Full TimeSan Mateo, CA, United States R11d ago
-
Machine Learning Engineer, Ads USD 165K-230KA/B | A/B Testing | B testing | Bidding | Conversion PredictionDirect impact | Hybrid work model | International team collaboration | Professional growth opportunities | Remote work flexibilityMid-level Full TimeSan Francisco Bay Area, USA R11d ago
-
Senior AI Applied Scientist II CAD 150K-177KAgent systems | Agentic AI | Autogen | Axolotl | BERTScoreFlexible vacation policy | Free whole-body scans | Health, dental, vision benefits | Mental health coverage | RRSP accessSenior-level Full TimeVancouver, British Columbia, Canada R12d ago
-
Senior AI Applied Scientist II CAD 150K-177KAgent systems | Autogen | BERTScore | CrewAI | DeepSpeedFlexible vacation policy | Free whole-body scans | Health, dental, vision coverage | Mental health coverage | Retirement savings plans accessSenior-level Full TimeVancouver, British Columbia, Canada12d ago
-
Agent systems | Decision Making | Fine Tuning | GPU Computing | JAXCompany pension | Flexible benefits platform | Flexible working | Gym discounts | Hybrid workSenior-level Full TimeGBR-Crawley Crompton Way, United Kingdom13d ago
-
Generative AI Intern SGD 40K-57KDeep learning | DeepSpeed | Distributed Training | Fine Tuning | Hugging FaceInternshipEntry-level Full Time InternshipSingapore Razer AI Center13d ago
-
Attention Optimization | CUDA | Data Generation | Deep learning | Distributed TrainingSenior-level Full TimeCanada, Toronto13d ago
-
Data Generation | Data Processing | DeepSpeed | Direct Preference Optimization | Distributed TrainingEntry-level Full TimeSan Jose, California, United States15d ago
-
Staff Machine Learning Engineer GBP 92K-170KBias Mitigation | Data Pipelines | Deployment | Direct Preference Optimization | Fine TuningSenior-level Full TimeUnited Kingdom R15d ago
-
Senior-level Full TimeBellevue R15d ago
-
Research Scientist (Generative & Agentic AI) - Tokyo,Japan. JPY 6000K-10000KBenchmarking | Distributed Training | Fine Tuning | Function Calling | Human FeedbackOverseas Candidate Support | Visa sponsorshipMid-level Full TimeTokyo, Japan17d ago
-
Machine Learning Engineer, API Multicloud USD 295K-445KAPIs | AWS | Data Pipelines | Data Structures | Data structures algorithmsSenior-level Full TimeSan Francisco17d ago
-
Senior Research Engineer, LLM Training & Post-Training USD 165K-310KCUDA | DPO | DeepSpeed | Distributed Training | Experiment design401k matching | Company holidays | Comprehensive health coverage | Dental coverage | Flexible time offSenior-level Full TimeNew York, New York, United States; … R17d ago
-
Software Engineer, Applied AI Infrastructure USD 193K-352KAttention | Batching | CI Failure Attribution | Cloud infrastructure | Context handlingSenior-level Full TimeMountain View, California (HQ)18d ago
-
Member of Technical Staff, LLM Post-Training, Applied USD 165K-300KConcurrency | Data Curation | Data Generation | Direct Preference Optimization | FP4Senior-level Full TimePalo Alto, CA19d ago
-
Senior Machine Learning Engineer USD 188K-282KAB Testing | Adversarial Machine Learning | Calibration monitoring | Canary Releases | Closed LoopSenior-level Full TimePalo Alto, CA19d ago
-
AI Researcher USD 295K-445KCache Compression | Deep learning | Direct Preference Optimization | Experiment design | Fine TuningFast Hiring Response | Immigration support | In person Work Mode | Permission to Publish | Relocation supportSenior-level Full TimeSan Francisco Office20d ago
-
大模型规划算法工程师- 北京 CNY 240K-480KAgent architecture | Agent systems | Context Management | Deep learning | Dialogue UnderstandingMid-level Full Time北京22d ago
-
Calibration | Data Generation | Deep learning | Distillation | EHREquity | Health benefits | High autonomySenior-level Full TimeNew York, NY, United States R23d ago
-
AI Researcher - Post-Training (f/m/d) EUR 75K-98KC# | C++ | Data Curation | Efficient Fine Tuning | Fine TuningSenior-level Full TimeBochum24d ago
-
Applied AI/ML Scientist USD 175K-260KCurve Analysis | Data Preprocessing | Deep learning | Direct Preference Optimization | Distributed TrainingMid-level Full TimeUAE25d ago
-
Active Learning | Adaptive Sampling | Deep learning | Direct Preference Optimization | Human FeedbackMid-level Full TimeSan Francisco, California; Remote, US or … R25d ago
-
Machine Learning Engineer (T25) INR 3584K-5876KBenchmarking | Embeddings | Experimentation | Feedback loop | Fine TuningSenior-level Full TimeBangalore, India26d ago
-
AWS | Azure | Cloud platform | Direct Preference Optimization | Fine TuningComprehensive benefits package | Remote work | Travel to enterprise customers | Visa sponsorship possibleMid-level Full TimeSan Mateo R26d ago
-
AI Feedback | Agent Orchestration | C++ | Context Compaction | Context EditingCommunity events | Industry expert collaboration | Professional development eventsEntry-level InternshipSingapore27d ago
-
C++ | Context engineering | Data Flywheel | Deep learning | Direct Preference OptimizationCareer guidance | Development workshops | Hands-on experience | Industry exposure | Social eventsEntry-level InternshipSingapore27d ago
-
Agent systems | C++ | Context engineering | Deep learning | Direct Preference OptimizationDevelopment workshops | Hands-on experience | Industry exposure | Learning programs | Social eventsEntry-level InternshipSingapore27d ago
-
AI Agent Algorithm Engineer Intern (Global E-Commerce, Conversational AI) - 2027 Start (PhD) SGD 57K-60KAI Feedback | C++ | Context Summarization | Deep learning | Direct Preference OptimizationEntry-level InternshipSingapore27d ago
-
AI Agent Algorithm Engineer Graduate (Global E-Commerce, Conversational AI) - 2027 Start SGD 60K-65KC++ | Context Compaction | Context Summarization | Deep learning | Direct Preference OptimizationEntry-level Full TimeSingapore27d ago
-
Agent runtime | C++ | Context Summarization | Deep learning | Direct Preference OptimizationEntry-level Full TimeSingapore27d ago
-
AI Agent Algorithm Engineer Graduate (Global E-Commerce, Conversational AI) - 2027 Start (PhD) SGD 60K-60KAI Feedback | Agent Orchestration | C++ | Context Summarization | Cost OptimizationEntry-level Full TimeSingapore27d ago