← voltar para vagas
// vaga nova · acesso antecipado (48h) · empresa e link abrem quando completar 48h

engenheiro de dados sênior - databricks e spark

@ ██████ · ·HÍBRIDO · SÃO PAULO, SÃO PAULO, BRASIL

Sobre a vaga

Estamos em busca de um Engenheiro de Dados Sênior para integrar o time de dados da empresa. Você será responsável por projetar, construir e manter pipelines de dados escaláveis usando Databricks e Apache Spark, além de garantir a qualidade e governança dos dados com Unity Catalog e Delta Lake.

Responsabilidades

  • Desenvolver e otimizar pipelines de dados utilizando Databricks, Spark e PySpark
  • Gerenciar e versionar dados em Delta Lake e Apache Iceberg
  • Implementar soluções de integração e orquestração com Databricks Workflows e Jobs
  • Trabalhar com armazenamento e processamento em AWS (S3, Glue, Lake Formation) e Google Cloud Platform
  • Garantir a qualidade dos dados e boas práticas de CI/CD e versionamento com Git
  • Colaborar com equipes de produto e engenharia para entender requisitos de dados

Requisitos

  • Experiência sólida com Databricks e Apache Spark (PySpark e Scala)
  • Conhecimento em Delta Lake, Apache Iceberg e Unity Catalog
  • Familiaridade com SQL avançado e modelagem de dados
  • Experiência com AWS (S3, Glue, Lake Formation) e/ou GCP
  • Domínio de Git e práticas de CI/CD
  • Inglês técnico para leitura e documentação

Diferenciais

  • Experiência com streaming de dados (Kafka, Kinesis)
  • Conhecimento em infraestrutura como código (Terraform, CloudFormation)
  • Familiaridade com containers e orquestração (Docker, Kubernetes)

Benefícios

  • Plano de saúde e odontológico
  • Vale-refeição ou alimentação
  • Horário flexível e modelo híbrido
  • Incentivo à certificações e cursos