engenheiro de dados sênior
Sobre a vaga
Buscamos um(a) Engenheiro(a) de Dados Sênior para integrar o time de dados da empresa, atuando em modelo híbrido no escritório de São Paulo. Você será responsável por projetar, construir e manter pipelines de dados escaláveis e robustos, garantindo a disponibilidade e qualidade das informações para análises e modelos de machine learning.
Responsabilidades
- Desenvolver e otimizar pipelines de dados utilizando Python, PySpark e SQL
- Gerenciar infraestrutura de dados em nuvem (AWS, GCP, Azure) com foco em AWS
- Orquestrar workflows com Airflow, Dagster ou Step Functions
- Implementar monitoramento e observabilidade com Prometheus, Grafana e Datadog
- Colaborar com times de ML para deploy de modelos usando MLflow, SageMaker e Kubeflow
- Garantir boas práticas de versionamento e CI/CD com GitHub Actions, GitLab CI ou Jenkins
Requisitos
- Experiência sólida em Engenharia de Dados (nível sênior)
- Domínio de Python e PySpark
- Conhecimento avançado em SQL e modelagem de dados
- Experiência com serviços AWS (S3, Glue, EMR, Lambda, etc.)
- Familiaridade com Docker e Kubernetes
- Vivência com ferramentas de orquestração como Airflow
- Inglês técnico para leitura de documentação
Diferenciais
- Experiência com streaming (Kafka, Kinesis)
- Conhecimento em MLOps (MLflow, Feast, Evidently)
- Familiaridade com FastAPI e gRPC
- Noções de Terraform para infraestrutura como código
Benefícios
- Vale refeição ou alimentação
- Plano de saúde e odontológico
- Seguro de vida
- Participação nos lucros
- Home office híbrido com flexibilidade
- Acesso a plataformas de cursos e treinamentos