← voltar para vagas
pleno em sre - site reliability engineering
Sobre a vaga
Buscamos uma pessoa engenheira de confiabilidade (SRE) para atuar na manutenção e evolução da infraestrutura que sustenta nossos produtos. Você será responsável por garantir alta disponibilidade, escalabilidade e performance dos sistemas, atuando de forma colaborativa com os times de desenvolvimento.
Responsabilidades
- Projetar, implementar e gerenciar infraestrutura em nuvem (AWS) utilizando ferramentas como Terraform, CloudFormation e CDK.
- Monitorar a saúde dos sistemas com Prometheus, Grafana e Datadog, criando alertas e dashboards.
- Automatizar processos de deploy, scaling e recuperação de falhas.
- Participar de plantões de suporte e responder a incidentes, garantindo rápida resolução.
- Colaborar com times de desenvolvimento para melhorar a confiabilidade e performance das aplicações.
Requisitos
- Experiência com AWS (EC2, EKS, RDS, S3, VPC, IAM).
- Conhecimento sólido em Kubernetes e Docker.
- Familiaridade com ferramentas de monitoramento (Prometheus, Grafana, Datadog).
- Experiência com infraestrutura como código (Terraform, CloudFormation, CDK).
- Conhecimento em pipelines de CI/CD (GitHub Actions, GitLab CI, Jenkins).
- Domínio de Linux/Unix e scripting com Bash e Python.
Diferenciais
- Experiência com ambientes de alta disponibilidade e escalabilidade.
- Conhecimento em observabilidade e tracing distribuído.
- Participação em comunidades técnicas ou contribuições open source.
Benefícios
- Remuneração compatível com o mercado.
- Horário flexível e trabalho remoto.
- Plano de saúde e odontológico.
- Vale-alimentação ou refeição.
- Auxílio educação.