← voltar para vagas
// vaga nova · acesso antecipado (48h) · empresa e link abrem quando completar 48h
sênior em sre - infraestrutura em nuvem
Sobre a vaga
Buscamos uma pessoa sênior em Site Reliability Engineering para projetar, implementar e manter a infraestrutura em nuvem da empresa. Você será responsável por garantir a disponibilidade, escalabilidade e performance dos sistemas, atuando com foco em automação e observabilidade.
Responsabilidades
- Gerenciar clusters Kubernetes (EKS, GKE) e garantir sua operação contínua
- Implementar monitoramento e alertas com Prometheus, Grafana, CloudWatch, Cloud Monitoring, Datadog e Splunk
- Automatizar provisionamento de infraestrutura com Terraform
- Desenvolver scripts em Python e Bash para automação de tarefas
- Gerenciar service mesh com Istio
- Participar de plantões de incidentes e realizar análises pós-mortem
- Colaborar com times de desenvolvimento para melhorar a confiabilidade dos serviços
Requisitos
- Experiência sênior em SRE ou áreas correlatas
- Conhecimento profundo em AWS e/ou GCP
- Domínio de Kubernetes e ferramentas do ecossistema (EKS, GKE)
- Experiência com Terraform para infraestrutura como código
- Familiaridade com ferramentas de observabilidade (Prometheus, Grafana, Datadog, Splunk, CloudWatch, Cloud Monitoring)
- Habilidade em programação com Python e Bash
- Conhecimento em service mesh (Istio)
Diferenciais
- Experiência com CI/CD e GitOps
- Certificações AWS, GCP ou Kubernetes
- Contribuições para projetos open source
Benefícios
- Remoto total (horário flexível)
- Vale-refeição ou alimentação
- Plano de saúde e odontológico
- Seguro de vida
- Programa de desenvolvimento profissional