Research MLE (Training Optimization)大模型训练优化工程师
Canva
Beijing
Workplace: HybridFull timeFunction: Education & TrainingSkills: ["Communication","Problem-solving","Collaboration"]Lead system-first efforts to scale and optimize training for large-scale multimodal foundation models. Design distributed training systems using Megatron-LM, NVIDIA NeMo, FSDP, and Triton, improving GPU utilization, communication overhead, and memory efficiency. Partner with research and modeling teams to align systems with algorithmic needs, evaluate best practices for distributed training, and perform low-level optimization with custom CUDA or Triton kernels.

