Find jobs in AI/ML, Data Science and Big Data
5 results
for KV-cache management
(Skill/Tech stack)
-
Staff AI Engineer USD 151K-332KC++ | CUDA | CUDA kernel | CUDA kernel development | Cache ManagementHybrid work | In-person work | Remote work | Work-life balance supportSenior-level Full TimeSeattle (WA), United States R20h ago
-
Staff Software Engineer, GPU Inference USD 175K-260KAsynchronous execution | Benchmarking | C++ | CI/CD | CUDASenior-level Full TimeToronto Office21d ago
-
AI Inference Engineer GBP 80K-106KAutoscaling | Batching | CUDA | Cache Management | Capacity PlanningBiannual bonus | Breakfast allowance | Dinner allowance | Equity sign-on bonus | Expensed technologyMid-level Full TimeLondon, England, United Kingdom - Remote R29d ago
-
Cloud Inference Engineer USD 158K-273KAutoscaling | Batch Processing | Cache Management | Distributed Systems | Go401k matching | Flexible paid time off | Health insurance | Remote work option | Team events onsite and meetupsMid-level Full TimeUnited States / Canada1mo ago
-
Tech Lead Manager, Inference USD 207K-300KAutoscaling | Cache Management | Caching | Continuous batching | Deployment PipelinesSenior-level Full TimeSF Bay Area, CA1mo ago