← voltar para vagas
sre pleno
Sobre a vaga
Buscamos um(a) Site Reliability Engineer (SRE) de nível pleno para se juntar ao nosso time global. Você será responsável por garantir a confiabilidade, escalabilidade e performance dos sistemas, trabalhando com tecnologias de ponta.
Responsabilidades
- Gerenciar e manter clusters Kubernetes e infraestrutura Docker/Podman.
- Automatizar provisionamento e configuração com Terraform e Ansible.
- Implementar monitoramento e alertas com Prometheus, Grafana e VictoriaMetrics.
- Gerenciar pipelines CI/CD no GitLab CI.
- Atuar na otimização de redes, DNS, CDN e WAF (Cloudflare, Akamai).
- Suporte a sistemas Linux e serviços de mensageria (RabbitMQ, AMQP).
- Colaborar com equipes de desenvolvimento para melhorar a resiliência dos sistemas.
Requisitos
- Experiência com Linux e administração de sistemas.
- Conhecimento sólido em Kubernetes e Docker.
- Experiência com ferramentas de infraestrutura como código (Terraform, Ansible).
- Familiaridade com monitoramento e observabilidade (Prometheus, Grafana).
- Conhecimento em Git, AWS e/ou GCP.
- Inglês intermediário/avançado para comunicação global.
Diferenciais
- Experiência com Zabbix ou VictoriaMetrics.
- Conhecimento em RabbitMQ/AMQP.
- Familiaridade com Cloudflare e Akamai.
Benefícios
- Remoto global.
- Horário flexível.
- Oportunidade de trabalhar em um time diverso e distribuído.