- Robot type
- Robot AI and Software
- Location
- San CarlosCaliforniaUSA
- Job type
- Artificial Intelligence
- Posted
- Apr 30, 2026
Full-time
Inference
Job description
Genesis AI — Inference (San Carlos, California · San Francisco, California).
Job responsibilities
- Build low-latency inference pipelines for on-device deployment, enabling real-time next-token and diffusion-based control loops in robotics
- Design and optimize distributed inference systems on GPU clusters, pushing throughput with large-batch serving and efficient resource utilization
- Implement efficient low-level code (CUDA, Triton, custom kernels) and integrate it seamlessly into high-level frameworks
- Optimize workloads for both throughput (batching, scheduling, quantization) and latency (caching, memory management, graph compilation)
- Develop monitoring and debugging tools to guarantee reliability, determinism, and rapid diagnosis of regressions across both stacks
Similar jobs
Genesis AI · Artificial Intelligence
Member of Technical Staff, IT
San Carlos, California · San Francisco, California
Genesis AI · Artificial Intelligence
Quadrants: Compiler Lead
San Carlos, California · San Francisco, California
Genesis AI · Artificial Intelligence
Genesis-World: Core Physics Engineer
San Carlos, California · San Francisco, California
Genesis AI · Artificial Intelligence
Security
San Carlos, California · San Francisco, California
