aijobs.net

Member of Technical Staff, ML Inference Engineering

Palo Alto, CA

USD 165K-300K (estimate) Senior-level Full Time

Apply Save
Found 11d ago
Tasks
Perks/Benefits
Skills/Tech-stack

Autoscaling | Bare Metal | CUDA | Distributed Storage | Distributed Systems | FP16 | FP8 | Inference engine | Infiniband | Kubernetes | LLM serving | Language Model | Large Language Model | LoRA | Machine Learning | Mixed Precision | Model Optimization | Multi-GPU | Multi-LoRa | Multi-node | NVIDIA GPU | Python | Quantization | RoCE | Schedulers | Triton

Education

N/A

Roles

Engineer | Inference Engineer | Learning Engineer | ML Inference Engineer | Machine Learning Engineer | Software Engineer

Regions

North America

Countries

United States

States

California, US

Cities

Palo Alto, California, US

Apply Save
Language: en Views: 0 Clicks: 0 Saves: 0

Related jobs