← voltar para vagas
sênior em sre - engenharia de confiabilidade
Sobre a vaga
Buscamos uma pessoa Sênior em SRE para garantir a confiabilidade, escalabilidade e performance dos sistemas da empresa. Você atuará com monitoramento, automação e resposta a incidentes, colaborando com times de desenvolvimento para melhorar a resiliência dos serviços.
Responsabilidades
- Projetar e implementar soluções de monitoramento e observabilidade (Datadog, Grafana, Prometheus, Splunk, OpenTelemetry)
- Automatizar operações de infraestrutura com Terraform, Ansible e GitHub Actions
- Gerenciar clusters Kubernetes e pipelines de CI/CD (ArgoCD, Atlantis)
- Responder a incidentes, realizar análises de causa raiz e propor melhorias
- Trabalhar com times de desenvolvimento para garantir boas práticas de confiabilidade
Requisitos
- Experiência sólida com SRE ou áreas correlatas
- Conhecimento avançado em AWS, Azure ou GCP
- Domínio de Docker e Kubernetes
- Experiência com ferramentas de monitoramento (Datadog, Grafana, Prometheus, Splunk)
- Habilidade com automação (Terraform, Ansible)
- Programação em Python, Golang ou NodeJS
- Familiaridade com Linux e Windows
Diferenciais
- Experiência com OpenTelemetry e dd-trace
- Conhecimento em GitHub Actions, ArgoCD e Atlantis
- Certificações em cloud ou Kubernetes
Benefícios
- Remuneração compatível com o mercado
- Plano de saúde e odontológico
- Vale-refeição ou alimentação
- Participação nos lucros
- Horário flexível e trabalho remoto