ML Engineer, Inference & Optimization
Pika
Palo Alto
Workplace: OnsiteFull timeUSD 185,000 - 250,000 annuallyFunction: Software EngineeringExperience: 5+ yearsSkills: ["Collaboration","Communication","Problem-solving","Mentoring"]Senior Inference Engineer at an AI startup accelerating inference for video and language models. You will design high-performance inference pipelines, optimize GPU parallelism, implement acceleration techniques (quantization, attention), and deploy state-of-the-art videogen/LLM models at scale, collaborating across research and engineering to push real-time AI capabilities.

