aijobs.net

AI Inference Engineer

London, England, United Kingdom - Remote R

GBP 80K-106K (estimate) Mid-level Full Time

Apply Save
Found 1d ago
Tasks
Perks/Benefits
Skills/Tech-stack

Autoscaling | Batching | CUDA | Cache Management | Capacity Planning | Deep learning | GPU Computing | Inference Server | Inference Serving | KV cache | KV-cache management | Kubernetes | Latency optimization | Machine Learning | Model Optimization | Quantization | Request Routing | SGLang | Scheduling | Slurm | Speculative decoding | System Architecture | TensorRT-LLM | Throughput Optimization | Triton Inference | Triton Inference Server | VLLM

Education

N/A

Roles

AI | AI Inference Engineer | Engineer | Inference Engineer | Learning Engineer | Machine Learning Engineer

Regions

Europe

Countries

United Kingdom

States

England, GB

Cities

London, England, GB

Apply Save
Language: en Views: 0 Clicks: 0 Saves: 0

Related jobs