← voltar para vagas
sre pleno - infraestrutura e confiabilidade
Sobre a vaga
Buscamos uma pessoa engenheira de confiabilidade (SRE) para garantir a estabilidade, performance e evolução da infraestrutura da empresa. Você atuará em um time que valoriza automação, observabilidade e boas práticas de operação.
Responsabilidades
- Projetar, implementar e manter infraestrutura em nuvem (AWS e GCP) usando Kubernetes, Docker e ferramentas GitOps (ArgoCD, Argo Workflows)
- Automatizar provisionamento com OpenTofu e Terragrunt
- Monitorar sistemas com Prometheus e Grafana, garantindo SLIs e SLOs
- Participar de plantões de incidentes e conduzir análises pós-incidente
- Colaborar com times de desenvolvimento para melhorar confiabilidade e performance de aplicações
- Gerenciar filas de mensageria (RabbitMQ, Kafka) e pipelines de dados (Snowflake)
Requisitos
- Experiência com AWS e/ou GCP
- Conhecimento sólido em Kubernetes e Docker
- Familiaridade com Python, Go, TypeScript ou Bash para automação
- Experiência com CI/CD (GitHub Actions) e GitOps
- Conhecimento de redes: TCP/IP, DNS, HTTP/S
- Familiaridade com observabilidade (Prometheus, Grafana)
- Inglês técnico para leitura e documentação
Diferenciais
- Experiência com Argo Workflows, ArgoCD, OpenTofu, Terragrunt
- Conhecimento em RabbitMQ, Kafka, Snowflake
- Noções de compliance (SOC 2, LGPD/GDPR)
Benefícios
- Remoto total
- Horário flexível
- Ambiente colaborativo e foco em aprendizado contínuo