Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) – Storage
Brazil
Workplace: OnsiteFull timeFunction: DevOps, Cloud & InfrastructureExperience: 5+ yearsEducation: bachelorsSkills: ["Analytical thinking","Problem-solving","Troubleshooting","Collaboration","Incident analysis"]Design, develop, and maintain automated storage-service lifecycle workflows, from provisioning and capacity management to replication integrity monitoring, firmware management, and decommissioning—run via pipelines without direct production array interaction. Operate reliability practices using SLIs, SLOs, and error budgets, improve observability with monitoring and telemetry tools, and perform structured incident analyses. Partner across Storage Engineering, Platform Automation, and Observability to integrate automation into the corporate AI/agentic ecosystem and drive continuous improvement.

