Machine Learning Engineer - AI Compiler Optimization
ByteDance
San Jose
Workplace: OnsiteFull timeFunction: Data Science & Machine LearningSkills: ["Performance optimization","Collaboration","Problem-solving","Technical analysis"]Build and implement an AI compiler optimization system for recommendation models, designing full-stack optimizations across graph, operator, and memory levels. Partner with hardware and algorithm teams on hardware-software co-design, and adapt recommendation models from PyTorch for efficient import, conversion, and code generation. Focus on GPU/NPU compilation performance improvements, including loop, memory, and operator optimization, to enable low-latency inference at scale.

