← voltar para vagas

sre pleno

@ SOCIAL DISCOVERY GROUP · ·REMOTO · ESTADOS UNIDOS, JAPÃO, EUROPA, ÁFRICA, ÁSIA, AMÉRICA DO NORTE, AMÉRICA DO SUL OU AUSTRÁLIA

Sobre a vaga

Buscamos um(a) Site Reliability Engineer (SRE) de nível pleno para se juntar ao nosso time global. Você será responsável por garantir a confiabilidade, escalabilidade e performance dos sistemas, trabalhando com tecnologias de ponta.

Responsabilidades

  • Gerenciar e manter clusters Kubernetes e infraestrutura Docker/Podman.
  • Automatizar provisionamento e configuração com Terraform e Ansible.
  • Implementar monitoramento e alertas com Prometheus, Grafana e VictoriaMetrics.
  • Gerenciar pipelines CI/CD no GitLab CI.
  • Atuar na otimização de redes, DNS, CDN e WAF (Cloudflare, Akamai).
  • Suporte a sistemas Linux e serviços de mensageria (RabbitMQ, AMQP).
  • Colaborar com equipes de desenvolvimento para melhorar a resiliência dos sistemas.

Requisitos

  • Experiência com Linux e administração de sistemas.
  • Conhecimento sólido em Kubernetes e Docker.
  • Experiência com ferramentas de infraestrutura como código (Terraform, Ansible).
  • Familiaridade com monitoramento e observabilidade (Prometheus, Grafana).
  • Conhecimento em Git, AWS e/ou GCP.
  • Inglês intermediário/avançado para comunicação global.

Diferenciais

  • Experiência com Zabbix ou VictoriaMetrics.
  • Conhecimento em RabbitMQ/AMQP.
  • Familiaridade com Cloudflare e Akamai.

Benefícios

  • Remoto global.
  • Horário flexível.
  • Oportunidade de trabalhar em um time diverso e distribuído.
§

>> antes de aplicar