Estamos em busca de um(a) Analista SRE Pleno ou Sênior para atuar em um ambiente de alta complexidade, contribuindo diretamente para a disponibilidade, confiabilidade, performance e evolução dos ambientes tecnológicos.
Se você possui experiência com AWS, Cloud, CI/CD, Observabilidade e troubleshooting, essa oportunidade pode fazer sentido para você!
O que você irá fazer:
- Atuar na sustentação e evolução de ambientes AWS, garantindo alta disponibilidade e confiabilidade;
- Implementar e manter pipelines de CI/CD, integrados ao Git e a ferramentas de automação;
- Desenvolver e operar soluções utilizando AWS Lambda, EKS, ECS e EC2;
- Realizar análises aprofundadas (drill down) em ferramentas de observabilidade e monitoramento, identificando causas e atuando na resolução de incidentes;
- Administrar ambientes Linux e Windows, aplicando boas práticas de segurança e automação;
- Atuar na resposta a incidentes, análise de causa raiz (RCA) e elaboração de postmortems;
- Trabalhar em parceria com os times de Desenvolvimento e Operações, fortalecendo a cultura DevOps/SRE.
O que você precisa ter/saber:
- Experiência prática com AWS, especialmente Lambda, EKS, ECS e EC2;
- Conhecimento em pipelines de CI/CD e versionamento com Git;
- Experiência com Observabilidade e Monitoramento, utilizando ferramentas como CloudWatch, Prometheus, Grafana, ELK ou similares;
- Conhecimento em administração de ambientes Linux e Windows;
- Familiaridade com ferramentas de automação e Infrastructure as Code (IaC), como Terraform, Ansible ou equivalentes;
- Experiência com troubleshooting avançado e capacidade de realizar análises aprofundadas em ambientes complexos;
- Perfil analítico, colaborativo e orientado à resolução de problemas.
Perfil que buscamos:
Buscamos profissionais que tenham senso de responsabilidade sobre os ambientes, sejam protagonistas na resolução de incidentes e tenham interesse em atuar na melhoria contínua de confiabilidade, automação, observabilidade e performance.