Machine Learning Engineer
Tasks
- Accelerate deployment cycles and remove operational bottlenecks
- Build automated machine learning infrastructure
- Deploy scalable low latency prediction endpoints
- Design CI CD and continuous training pipelines
- Implement automated monitoring and alerting for model drift
- Maintain unit testing and version control best practices
- Operationalize machine learning models for production
- Run containerized workloads on Kubernetes
Perks/Benefits
- N/A
Skills/Tech-stack
AI Pipelines | AI Workbench | AI endpoints | API Development | Apache Kafka | CI/CD | Cloud Build | Cloud platform | Continuous Training | Data Drift | Docker | GCP Pub/Sub | Google Cloud | Google Cloud Platform | Google Kubernetes | Google Kubernetes Engine | Infrastructure as Code | Kubernetes | Kubernetes Engine | MLOps | Model Drift | Model Monitoring | Pub/Sub | Python | Terraform | Unit Testing | Vertex AI | Vertex AI Endpoints | Vertex AI Workbench | Vertex AI pipelines | “as-code”
Education
N/A
Related jobs
-
Featured Feat. Principal Knowledge & Data Architect USD 174K-284KAWS Neptune | Canonicalization | Chunking | Cypher | DBTBenefits including health and wellness programs | Health, wellness, and retirement plansSenior-level Full TimeHeadquarters - Chevy Chase, MD R19d ago
-
Model Operations Engineer USD 107K-179KALiBi | AWS SageMaker | Amazon Lambda | Apache Airflow | AzureHealth insurance | Holiday pay | Learning and development | Life insurance | Long-term disabilitySenior-level Full TimeUSA-VA-Ashburn2h ago
-
AWS DMS | AWS Database | AWS Database Migration Service | AWS VPC | AWS database migrationSenior-level ContractAustin, United States3h ago
-
AI Search | API Design | API Integration | Azure AI | Azure AI LanguageSenior-level ContractColumbus, United States3h ago
-
Computer Vision | Data parallelism | Deep learning | Distributed Training | Model AccelerationSenior-level Full TimeSeattle, Washington, United States3h ago
-
Software Development Engineer - AI/LLM Network - Global Frontier Tech Research Program - 2027 Start (PhD) USD 202K-368KAI infrastructure | C++ | Cause analysis | Elastic scaling | Fault LocalizationEntry-level Full TimeSeattle, Washington, United States3h ago
-
Distributed Systems | Inference | Machine Learning | Model Serving | MonitoringSenior-level Full TimeSan Jose, California, United States3h ago
-
Lead Machine Learning Engineer (Multiple Positions) USD 275K-450KAlgorithm Optimization | Code review | Data Pipelines | Deep learning | Infrastructure OptimizationSenior-level Full TimeSan Jose, California, United States3h ago
-
Machine Learning Engineer (Multiple Positions) USD 174K-316KData Pipelines | Deep learning | Linux | Machine Learning | Model ServingMid-level Full TimeSan Jose, California, United States3h ago
-
Cloud Native | Containerization | Distributed Systems | GPU Acceleration | KubernetesCareer growth | Collaborative engineering environment | Global opportunities | Open Source contributionEntry-level Full TimeSan Jose, California, United States3h ago
-
Deep learning | GPU resource management | Language Models | Large Language Models | Machine LearningEntry-level InternshipSan Jose, California, United States3h ago
-
LLM AIOps Development Engineer Graduate (Data Center Networking) - 2026 Start (BS/ MS) USD 122K-256KAPI Integration | Anomaly Detection | Cause analysis | Continuous Monitoring | Data StreamingEntry-level Full TimeSan Jose, California, United States3h ago
-
AI | Big Data | CPU | Cloud Native | Container RuntimeSenior-level Full TimeSan Jose, California, United States3h ago
-
Cloud Native | Cloud-native computing | Containerization | Distributed Systems | GPU AccelerationCareer growth | Collaborative team environment | Open source contributionsEntry-level Full TimeSeattle, Washington, United States3h ago
-
Production Engineer - Applied Machine Learning USD 156K-387KAlerting | Auto Scaling | Auto rollback | Auto-healing | CI/CDEntry-level Full TimeSan Jose, California, United States3h ago
-
CUDA | Distributed Systems | GPU | Language Models | Large Language ModelsCareer growth | Global team collaborationEntry-level Full TimeSan Jose, California, United States3h ago
-
Backup and Restore | Blob Storage | Cause analysis | Debugging | Distributed SystemsAgile environment | Collaborative team | On-call rotationSenior-level Full TimeSan Jose, California, United States3h ago
-
Containerd | Docker | Go | Kubernetes | LinuxSenior-level Full TimeSeattle, Washington, United States3h ago
-
Site Reliability Engineer - Data (Seattle) USD 177K-341KApache Flink | Blameless postmortems | Capacity Planning | Incident Response | KubernetesMid-level Full TimeSeattle, Washington, United States3h ago
-
Software Engineer - AI Compute Infrastructure USD 156K-387KCloud Native | Cluster management | Distributed Systems | GPU Acceleration | KubernetesSenior-level Full TimeSan Jose, California, United States3h ago
-
Site Reliability Engineer - Data USD 136K-359KApache Flink | Automation | Capacity Planning | Cloud infrastructure | Incident ManagementMid-level Full TimeSan Jose, California, United States3h ago
-
Machine Learning Engineer Intern (E-commerce Governance Algorithms) - 2026 Summer (BS/MS) USD 129K-256KAlgorithm Design | Data Analysis | Fraud Detection | Machine Learning | PythonEntry-level InternshipSeattle, Washington, United States3h ago
-
Automated Deployment | Backup and Recovery | Column-stores | Data Consistency | Database AdministrationSenior-level Full TimeSeattle, Washington, United States3h ago
-
Deep learning | GPU Computing | Language Models | Large Language Models | Machine LearningEntry-level InternshipSan Jose, California, United States3h ago
-
Agentic technology | C++ | Data Mining | Human Feedback | Information RetrievalSenior-level Full TimeMenlo Park, CA4h ago