aijobs.net

Research Engineer / Scientist - Storage for LLM

Seattle, Washington, United States R

USD 153K-300K Mid-level Full Time

Apply Save
Found 4h ago
Tasks
Perks/Benefits
Skills/Tech-stack

Batching | C++ | CUDA | CUDA Networking | CUDA aware Networking | CUDA programming | Cache aware scheduling | Caching | Distributed Systems | Eviction Policy | GDR | GDS | GPU communication | GPU-to-GPU | GPU-to-GPU communication | GRPC | Go | HBM | High Performance | High-Performance Computing | Inference Server | Infiniband | KV cache | Language Models | Large Language Models | Low Latency | Low-Latency Systems | Memory Management | NCCL | NUMA | NVIDIA GPUs | NVLink | Performance Computing | Prefetching | RDMA | RPC | Rust | TensorRT | Transformer | Triton Inference | Triton Inference Server

Education

PhD

Roles

Engineer | Research Engineer | Research Scientist | Scientist | Systems Engineer

Regions

North America

Countries

United States

States

Washington, US

Cities

Seattle, Washington, US

Apply Save
Language: en Views: 0 Clicks: 0 Saves: 0

Related jobs