← voltar para vagas

pleno em sre - site reliability engineering

@ BLOSSOM · ·REMOTO · COLÔMBIA

Sobre a vaga

Buscamos uma pessoa engenheira de confiabilidade (SRE) para atuar na manutenção e evolução da infraestrutura que sustenta nossos produtos. Você será responsável por garantir alta disponibilidade, escalabilidade e performance dos sistemas, atuando de forma colaborativa com os times de desenvolvimento.

Responsabilidades

  • Projetar, implementar e gerenciar infraestrutura em nuvem (AWS) utilizando ferramentas como Terraform, CloudFormation e CDK.
  • Monitorar a saúde dos sistemas com Prometheus, Grafana e Datadog, criando alertas e dashboards.
  • Automatizar processos de deploy, scaling e recuperação de falhas.
  • Participar de plantões de suporte e responder a incidentes, garantindo rápida resolução.
  • Colaborar com times de desenvolvimento para melhorar a confiabilidade e performance das aplicações.

Requisitos

  • Experiência com AWS (EC2, EKS, RDS, S3, VPC, IAM).
  • Conhecimento sólido em Kubernetes e Docker.
  • Familiaridade com ferramentas de monitoramento (Prometheus, Grafana, Datadog).
  • Experiência com infraestrutura como código (Terraform, CloudFormation, CDK).
  • Conhecimento em pipelines de CI/CD (GitHub Actions, GitLab CI, Jenkins).
  • Domínio de Linux/Unix e scripting com Bash e Python.

Diferenciais

  • Experiência com ambientes de alta disponibilidade e escalabilidade.
  • Conhecimento em observabilidade e tracing distribuído.
  • Participação em comunidades técnicas ou contribuições open source.

Benefícios

  • Remuneração compatível com o mercado.
  • Horário flexível e trabalho remoto.
  • Plano de saúde e odontológico.
  • Vale-alimentação ou refeição.
  • Auxílio educação.
§

>> antes de aplicar