Find jobs in AI/ML, Data Science and Big Data
123 results
for Supervised Fine Tuning
(Skill/Tech stack)
-
Applied Scientist, Alexa Connected Devices USD 142K-193KAlgorithms | C++ | Data Mining | Data Structures | Distributed Computing401k matching | Dental insurance | EAP mental health support | Health insurance | Paid time offMid-level Full TimeSeattle, Washington, USA1d ago
-
AI & Machine Learning Teaching Expert (Part-time) USD 100K-200KA/B | A/B Testing | Agentic Systems | Artificial Intelligence | B testingFlexible schedule | Fully remote | Professional autonomy | Use of collaboration tools Notion Slack ZoomSenior-level Part TimeBoston, US R1d ago
-
Staff Machine Learning Engineer, Personalization USD 227K-324KA/B | A/B Testing | Airflow | B testing | BigQuery401k retirement plan | Flexible holidays | Health insurance | Meal allowance | Paid parental leaveSenior-level Full TimeNew York, NY2d ago
-
Vice President – AI Engineer INR 4111K-6000KAI RMF | AWS EC2 | AWS EKS | AWS IAM | Active-Active ReplicationExecutive-level Full TimePune, Gera Commerzone SEZ, India3d ago
-
Member of Technical Staff - ML Scientist, Japanese Multimodal JPY 8600K-10597KAblation Studies | Data Curation | Distillation | Error Analysis | EvaluationContinuous learning | Flexible working hours | Mentorship | Remote work | Travel opportunitiesSenior-level Full TimeTokyo3d ago
-
Agentic AI & Graph Machine Learning Research Engineer USD 128K-159KAgent communication | Agent2Agent | AgentOps | Agentic AI | Autogen401k match | Dental insurance | Gym facilities | Life insurance | Medical insuranceMid-level Full TimeCalabasas, CA3d ago
-
Applied AI Engineer USD 130K-220KAPI Orchestration | Agent architecture | Benchmarking | Browser Automation | Data Annotation401k retirement plan | Dental insurance | Employee wellness programs | Flexible work hours | Medical insuranceSenior-level Full TimeSeattle, WA3d ago
-
Autoscaling | Batching | CI/CD | Calibration | Cloud infrastructureDental insurance | Equity compensation | Health insurance | Hybrid work | Performance bonusSenior-level Full TimeNew York3d ago
-
Senior-level Full TimeIND, Remote R3d ago
-
Research Engineer / Scientist, Post-Training USD 295K-445KCatastrophic Forgetting | Data Mixtures | Deep learning | Experiment design | Fine TuningIn person work schedule | Open research publishing | Paid in person work trialMid-level Full TimeSan Francisco Office4d ago
-
Senior Manager-AI Algorithm CNY 144K-240KAPI Development | Agent Orchestration | Agentic AI | CI/CD | Cloud PlatformsSenior-level Full TimeChina4d ago
-
Senior-level Full TimeChina4d ago
-
Chain-of-Thought | Fine Tuning | Knowledge Distillation | Language Models | Language ProcessingEntry-level Full TimeSingapore, Singapore4d ago
-
AI Feedback | Context engineering | Data Curation | Deep learning | DeepSpeedSenior-level Full TimeSingapore, Singapore4d ago
-
AI Agents | Capacity Planning | Continuous Pretraining | Deep learning | Fine TuningEntry-level Full TimeSingapore, Singapore4d ago
-
Director of AI & Data Platform USD 232K-320KAccess Control | Anomaly Detection | Audit compliance | CDC | DBTExecutive-level Full TimeHo Chi Minh City, Ho Chi …5d ago
-
NLP AI Engineer USD 100K-150KBenchmarking | DPO | Data Generation | Distributed Training | Experiment trackingCareer growth | Mentorship | Remote workSenior-level Full TimeUnited States - Remote R5d ago
-
Machine Learning Research Engineer USD 120K-192KAgentic AI | Context engineering | Data Pipelines | Data labeling | Deep learningAnnual incentive program | Healthcare coverage | Retirement benefitsSenior-level Full TimeCambridge, MA USA5d ago
-
Staff Applied Scientist, UI Control Models USD 170K-300KBenchmarking | Data Curation | Fine Tuning | JAX | Language ModelsSenior-level Full TimeCupertino5d ago
-
Agent Framework | C++ | Fine Tuning | Graph Algorithms | Human FeedbackEntry-level Full TimeSingapore5d ago
-
Agent Frameworks | Algorithms | C plus plus | Data Structures | Fine TuningInternship experienceEntry-level InternshipSingapore5d ago
-
Axolotl | Data Preprocessing | Dataset curation | Deep learning | Direct Preference OptimizationContinuous learning | Fully remote | Inclusive workplace | International collaboration | Professional developmentMid-level Full TimeEstonia R6d ago
-
Axolotl | Direct Preference Optimization | Efficient Fine Tuning | Fine Tuning | Language ModelsContinuous learning | Equal opportunity | Fully remote | Inclusive workplace | International collaborationMid-level Full TimeHungary R6d ago
-
Axolotl | Data Curation | Data Preprocessing | Deep learning | Direct Preference OptimizationFully remote | Impactful projects | Inclusive workplace | International team collaboration | Open source exposureMid-level Full TimeFinland R6d ago
-
Axolotl | Dataset curation | Deep learning | Direct Preference Optimization | Efficient Fine TuningContinuous learning | Fully remote work | Professional developmentMid-level Full TimeCzechia R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Efficient Fine Tuning | Fine TuningContinuous learning and professional development | Fully remote | Inclusive collaborative workplace | International team collaborationMid-level Full TimeNorway R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Efficient Fine Tuning | Fine TuningContinuous learning and professional development | Exposure to open source AI projects | Fully remote work | Healthcare and life sciences impactful projects | Inclusive diverse workplaceMid-level Full TimeLuxembourg R6d ago
-
AI Engineering | Axolotl | Data Curation | Deep learning | Direct Preference OptimizationContinuous learning | Exposure to Open Source AI | Fully remote | International collaboration | Professional developmentMid-level Full TimeCroatia R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Efficient Fine Tuning | Fine TuningContinuous learning | Fully remote work | Inclusive workplace | International team collaboration | Professional developmentMid-level Full TimeBulgaria R6d ago
-
Axolotl | Datasets | Deep learning | Direct Preference Optimization | Efficient Fine TuningContinuous learning | Exposure to Open Source AI | Fully remote work | Inclusive diverse workplace | International team collaborationMid-level Full TimeDenmark R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Efficient Fine Tuning | Fine TuningContinuous learning and professional development | Fully remote work environment | Inclusive diverse workplace | International team collaborationMid-level Full TimeGreece R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Distributed Systems | Efficient Fine TuningContinuous learning | Fully remote | International team collaboration | Professional developmentMid-level Full TimeChile R6d ago
-
Axolotl | Dataset curation | Deep learning | Direct Preference Optimization | Efficient Fine TuningContinuous learning | Fully remote work | Inclusive workplace | International team collaboration | Open source exposureMid-level Full TimePoland R6d ago
-
Axolotl | Direct Preference Optimization | Efficient Fine Tuning | Fine Tuning | Language ModelsContinuous learning and professional development | Exposure to Open Source AI | Fully remote work environment | Inclusive diverse collaborative workplace | Opportunity to work on cutting-edge AIMid-level Full TimeAustria R6d ago
-
Axolotl | Dataset curation | Deep learning | Direct Preference Optimization | Distributed TeamsContinuous learning | Fully remote | Inclusive workplace | International team collaboration | Opportunity to Work on Open SourceMid-level Full TimeSweden R6d ago
-
Deep learning | Direct Preference Optimization | Efficient Fine Tuning | Fine Tuning | Language ModelsContinuous learning | Fully remote | Inclusive workplace | International collaboration | Open source exposureMid-level Full TimeIsrael R6d ago
-
Axolotl | Dataset curation | Deep learning | Direct Preference Optimization | Efficient Fine TuningContinuous learning | Fully remote | Inclusive workplace | International team collaboration | Professional developmentMid-level Full TimeSaudi Arabia R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Efficient Fine Tuning | Fine TuningContinuous learning | Fully remote work | Inclusive workplace | International collaboration | Professional developmentMid-level Full TimeBelgium R6d ago
-
Axolotl | Dataset Preparation | Deep learning | Direct Preference Optimization | Efficient Fine TuningContinuous learning and professional development | Exposure to open source AI projects | Fully remote work environment | Inclusive diverse workplace | International team collaborationMid-level Full TimeUnited Arab Emirates R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Distributed Systems | Efficient Fine TuningContinuous learning | Exposure to Open Source AI | Fully remote work | International collaboration | Professional developmentMid-level Full TimeTurkey R6d ago
-
Axolotl | Direct Preference Optimization | Distributed Systems | Efficient Fine Tuning | Fine TuningContinuous learning opportunities | Fully remote work | Inclusive workplace | International collaboration | Open source exposureMid-level Full TimeAustralia R6d ago
-
Axolotl | Data Curation | Data Preprocessing | Direct Preference Optimization | Distributed SystemsContinuous learning | Fully remote | Inclusive workplace | International team collaboration | Open source exposureMid-level Full TimeSouth Africa R6d ago
-
Deep learning | Direct Preference Optimization | Efficient Fine Tuning | Fine Tuning | Language ModelsContinuous learning and professional development | Fully remote work environment | Inclusive diverse workplaceMid-level Full TimeMexico R6d ago
-
Axolotl | Data cleaning | Dataset Preparation | Deep learning | Direct Preference OptimizationContinuous learning | Fully remote | Inclusive workplace | International collaboration | Professional developmentMid-level Full TimeRomania R6d ago
-
Data Preprocessing | Dataset curation | Deep learning | Direct Preference Optimization | Efficient Fine TuningContinuous learning and professional development | Fully remote work | Inclusive workplace | International team collaborationMid-level Full TimeItaly R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Efficient Fine Tuning | Fine TuningContinuous learning | Fully remote | International team collaboration | Professional developmentMid-level Full TimePortugal R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Efficient Fine Tuning | Fine TuningContinuous learning and professional development | Exposure to open source AI projects | Fully remote work | Inclusive diverse workplace | International team collaborationMid-level Full TimeNetherlands R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Efficient Fine Tuning | Fine TuningContinuous learning and professional development | Exposure to Open Source AI | Fully remote work environment | Inclusive diverse collaborative workplace | Opportunity to work on cutting-edge technologiesMid-level Full TimeIreland R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Efficient Fine Tuning | Fine TuningContinuous learning | Fully remote work | Inclusive workplace | Opportunity to work on cutting-edge AI | Professional developmentMid-level Full TimeSwitzerland R6d ago
-
Axolotl | Deep learning | Direct Preference Optimization | Distributed Systems | Efficient Fine TuningContinuous learning | Fully remote work | Inclusive workplace | International team collaboration | Open source exposureMid-level Full TimeFrance R6d ago