aijobs.net

Senior Research Engineer / Scientist - Storage for LLM

Seattle, Washington, United States R

USD 207K-368K Senior-level Full Time

Apply Save
Found 3h ago
Tasks
Perks/Benefits
Skills/Tech-stack

Autoregressive decoding | Batched decoding | C++ | CUDA | CUDA aware Networking | Cache consistency | Distributed Systems | Eviction policies | GDR | GDS | GRPC | Go | HBM | Inference Server | Infiniband | KV cache | LRU | Language Models | Large Language Models | Low Latency | Low-latency serving | Memory Management | Model Parallelism | NCCL | NUMA | NVIDIA GPUs | NVLink | RDMA | RPC | Replication | Rust | Sharding | Synchronization protocols | TTL | TensorRT | Token streaming | Transformer | Triton Inference | Triton Inference Server

Education

PhD

Roles

Engineer | Research Engineer | Research Scientist | Scientist | Senior Research Engineer | Senior Research Scientist

Regions

North America

Countries

United States

States

Washington, US

Cities

Seattle, Washington, US

Apply Save
Language: en Views: 1 Clicks: 0 Saves: 0

Related jobs