aijobs.net

Principal Site Reliability Engineer, Machine Learning

Cambridge, MA

USD 142K-177K Senior-level Full Time

Apply Save
Found 16h ago
Tasks
Perks/Benefits
Skills/Tech-stack

AWS DynamoDB | AWS EC2 | AWS IAM | AWS Lambda | AWS SQS | Amazon Aurora | Amazon EKS | Amazon RDS | Amazon S3 | Amazon Web Services | Autoscaling | CI/CD | Capacity Planning | CloudWatch | Cost Optimization | Databricks | Datadog | Docker | Error budget | GPU scheduling | Incident Response | Infrastructure as Code | Job orchestration | Kubernetes | Linux | Observability | On Demand | On Demand Capacity Reservations | Postmortem | Ray | Reliability Engineering | SLO | Site Reliability | Site Reliability Engineering | Spot instances | System design | Terraform | Unity Catalog | Web Services | Workspace administration | “as-code”

Education

Bachelor of Engineering | Bachelor of Science

Roles

Engineer | Principal | Principal Site Reliability Engineer | Reliability Engineer | Site Reliability Engineer

Regions

North America

Countries

United States

States

Massachusetts, US

Cities

Cambridge, Massachusetts, US

Apply Save
Language: en Views: 0 Clicks: 0 Saves: 0

Related jobs