← voltar para vagas
// vaga nova · acesso antecipado (48h) · empresa e link abrem quando completar 48h
pleno em sre
Sobre a vaga
Buscamos uma pessoa engenheira de confiabilidade de sites (SRE) para atuar de forma remota no Brasil, garantindo a estabilidade e performance de sistemas críticos.
Responsabilidades
- Projetar, implementar e manter infraestrutura em nuvem (AWS) com Kubernetes e Terraform.
- Monitorar sistemas usando Prometheus, Grafana e Thanos, atuando em incidentes e resolvendo problemas de performance.
- Automatizar operações com Helm, Go e scripts em Linux.
- Gerenciar bancos de dados como MongoDB e Redis, além de componentes de rede (DNS, TCP/IP, HTTP, TLS, UDP).
- Colaborar com times de desenvolvimento para melhorar a confiabilidade e escalabilidade dos serviços.
Requisitos
- Experiência com Kubernetes e ambientes de containers.
- Sólidos conhecimentos em AWS (EKS, EC2, etc.) e infraestrutura como código (Terraform).
- Familiaridade com ferramentas de observabilidade: Prometheus, Grafana e Thanos.
- Conhecimento de linguagens de programação, especialmente Go.
- Noções de redes: DNS, TCP/IP, HTTP, TLS e UDP.
- Experiência com MongoDB, Redis e Helm.
Diferenciais
- Experiência com GCP ou Azure.
- Conhecimento em Rancher.
- Contribuições para projetos open source na área de SRE.
Benefícios
- Trabalho remoto de qualquer lugar do Brasil.
- Horários flexíveis.
- Participação em eventos e cursos.