AI Research Engineer (Model Compression & Quantization)
Tether.io
Dublin
Workplace: RemoteFull timeFunction: Research & Scientific (R&D)Education: bachelorsSkills: ["PyTorch","Quantization","Quantization-Aware Training","QAT","Post-Training Quantization","PTQ","Knowledge distillation","Pruning","Transformers","NLP","Machine learning","Fine-tuning","C++"]Join an AI research team focused on model compression and efficient deployment for multimodal AI systems (LLMs, VLMs) to reduce footprint and latency while preserving accuracy. You will develop quantization, distillation, and pruning pipelines, experiment with mixed-precision strategies, publish results, and contribute to cutting-edge compression techniques for edge devices.

