AI Research Engineer (Model Compression & Quantization)
Tether.io
Barcelona
Workplace: RemoteFull timeFunction: Research & Scientific (R&D)Education: bachelorsSkills: ["PyTorch","Quantization","Distillation","Pruning","Transformers","C++"]Join an AI research team focused on model compression and efficient deployment for multimodal AI systems (LLMs/VLMs). You will develop and evaluate quantization, distillation, and pruning strategies to reduce model footprint and latency on edge devices, build robust compression pipelines, and publish findings while advancing state-of-the-art in fintech AI applications.

