AI Research Engineer (Kernel & Inference Optimization) - 100% Remote Worldwide
Tether.io
Italy, Argentina, Colombia, Brazil, Uruguay, India, Bangladesh, Pakistan, Vietnam, Taiwan, Thailand, United Kingdom, Switzerland, Spain, United Arab Emirates, Bulgaria, Czech Republic, Serbia, Denmark, Estonia, Greece, Georgia, Budapest, Ireland, Malta, Norway, Amsterdam, Poland, Portugal, Romania, Sweden, Belgium, Israel, Cyprus
Workplace: RemoteFull timeFunction: Research & Scientific (R&D)Education: bachelorsSkills: ["MSL","GPU kernels","Model serving","Inference","Low-level optimization","Edge deployment","Latency optimization","Memory management","Tensor Parallelism","Pipeline Parallelism","Expert Parallelism","Diffusion Models","Vision Transformers","Pruning","Quantization","Flash attention","KV Cache","Speculative Decoding"]Join a global, remote AI model team focused on designing and optimizing state-of-the-art model serving and inference architectures. You will develop low-latency, memory-efficient inference pipelines for resource-constrained devices and edge platforms, pushing the boundaries of kernel and inference optimization across diverse environments.

