Senior AI Engineer - LLM Evaluation
Autodesk
Bengaluru
Workplace: OnsiteFull timeFunction: Data Science & Machine LearningExperience: 5+ yearsSkills: ["Python","Machine learning","Ai evaluation","Observability","Ci/cd","Benchmarking","Testing","Langsmith","Prompt engineering"]Lead AI evaluation and quality strategy for Generative AI and ML-powered systems. Design scalable evaluation frameworks for LLMs, RAG systems, and agentic workflows; fine-tune and deploy LLMs in production; implement observability standards; define AI quality metrics (accuracy, bias, drift, latency, safety) and integrate automated evaluation pipelines into CI/CD for continuous validation.

