← voltar para vagas
// vaga nova · acesso antecipado (48h) · empresa e link abrem quando completar 48h

sênior em sre - infraestrutura em nuvem

@ ███████████████ · ·REMOTO · BOGOTÁ, COLÔMBIA

Sobre a vaga

Buscamos uma pessoa sênior em Site Reliability Engineering para projetar, implementar e manter a infraestrutura em nuvem da empresa. Você será responsável por garantir a disponibilidade, escalabilidade e performance dos sistemas, atuando com foco em automação e observabilidade.

Responsabilidades

  • Gerenciar clusters Kubernetes (EKS, GKE) e garantir sua operação contínua
  • Implementar monitoramento e alertas com Prometheus, Grafana, CloudWatch, Cloud Monitoring, Datadog e Splunk
  • Automatizar provisionamento de infraestrutura com Terraform
  • Desenvolver scripts em Python e Bash para automação de tarefas
  • Gerenciar service mesh com Istio
  • Participar de plantões de incidentes e realizar análises pós-mortem
  • Colaborar com times de desenvolvimento para melhorar a confiabilidade dos serviços

Requisitos

  • Experiência sênior em SRE ou áreas correlatas
  • Conhecimento profundo em AWS e/ou GCP
  • Domínio de Kubernetes e ferramentas do ecossistema (EKS, GKE)
  • Experiência com Terraform para infraestrutura como código
  • Familiaridade com ferramentas de observabilidade (Prometheus, Grafana, Datadog, Splunk, CloudWatch, Cloud Monitoring)
  • Habilidade em programação com Python e Bash
  • Conhecimento em service mesh (Istio)

Diferenciais

  • Experiência com CI/CD e GitOps
  • Certificações AWS, GCP ou Kubernetes
  • Contribuições para projetos open source

Benefícios

  • Remoto total (horário flexível)
  • Vale-refeição ou alimentação
  • Plano de saúde e odontológico
  • Seguro de vida
  • Programa de desenvolvimento profissional