Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) - Server
Brazil
Workplace: OnsiteFull timeFunction: Hospitality & Food ServiceEducation: bachelorsSkills: ["Troubleshooting","Incident management","Continuous improvement","Cross-team collaboration","Root-cause analysis"]Projetar, desenvolver e operar automações para o ciclo de vida da infraestrutura compute, garantindo escalabilidade, disponibilidade e confiabilidade dos serviços. Definir e manter SLIs, SLOs e error budgets, aprimorar observabilidade e reduzir ruídos de monitoramento, conduzindo análises pós-incidente. Colaborar com equipes de Compute, Automação de Plataforma e Observabilidade para critérios de prontidão operacional e políticas como código. Participar do plantão de Compute para resolução de incidentes críticos.

