SRE (Matera) | Híbrido/SP - 136270
GFT Technologies SE Barueri, São Paulo, Brazil
IT Services and IT Consulting · 10,001+ employees
About the role
Lead critical incident response meetings and ensure effective communication between technical and business teams. Develop and maintain automation solutions to improve system performance, availability, and operational efficiency.
What they look for
Requirements
Requires proven experience in critical incident resolution and cloud infrastructure management across AWS, Azure, or GCP. Proficiency in observability tools and scripting languages like Python, Bash, or Go is essential.
Full description
O que buscamos: Um profissional com experiência em gestão de incidentes críticos, infraestrutura em nuvem, observabilidade e automação, com foco em colaboração e melhoria contínua de sistemas.
Responsabilidades:
- Liderar reuniões de resposta a incidentes críticos, garantindo comunicação clara entre times técnicos e de negócio;
- Atuar na identificação, mitigação e resolução de falhas em sistemas de produção, assegurando a continuidade dos serviços;
- Implementar e manter ferramentas que permitam visibilidade de performance e disponibilidade;
- Desenvolver soluções para reduzir tarefas manuais e aumentar a eficiência operacional;
- Propor e executar planos de ação pós-incidente, fortalecendo a resiliência dos sistemas;
Requisitos e Qualificações:
- Experiência comprovada em resolução de incidentes críticos e condução de salas de crise;
- Conhecimento em infraestrutura em nuvem (AWS, Azure ou GCP);
- Domínio de ferramentas de observabilidade (Prometheus, Grafana, ELK, etc.);
- Habilidade em automação com scripts (Python, Bash, Go);
- Perfil proativo, com excelente comunicação e capacidade de tomada de decisão sob pressão;
Diferenciais:
- Preferência por profissionais que já tenham atuado ou conheçam o ecossistema da Matera;
- Certificações em DevOps ou Cloud;
- Experiência em ambientes de alta disponibilidade e sistemas financeiros;
Similar roles
-
Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure)
Encora Perímetro Urbano Santiago de Cali, Valle del Cauca, Colombia
-
Site Reliability Engineer III - Performance Engineer- Service now
JPMorgan Chase & Co. San Francisco, California, United States · $138K–$185K/yr
-
Site Reliability Engineering Lead
Graphcore Austin, Texas, United States
-
Site Reliability Engineer
Prolaio Chicago, Illinois, United States · $118K/yr
-
Senior Site Reliability Engineer
Wesco Irving, Texas, United States · $82K–$139K/yr
-
ASKUSR0147035 Site Reliability Engineer - NERSC Operations
Essnova Solutions, Inc. Berkeley, California, United States · $156K/yr