AI Research Engineer (Model Compression & Quantization)
Tether.io
Rome, London
Workplace: RemoteFull timeFunction: Research & Scientific (R&D)Education: bachelorsSkills: ["Problem-solving","Research","Collaboration"]Join Tether's AI research team to drive model compression for multimodal AI, focusing on quantization, knowledge distillation, and pruning to run large language models and vision-language models efficiently on edge devices. Build robust compression pipelines, establish performance metrics, and balance model size, latency, and accuracy while publishing impactful results. This is a remote-friendly role with a global team shaping fintech AI.

