← voltar para vagas
pleno em engenharia de dados
Sobre a vaga
Estamos em busca de uma pessoa Engenheira de Dados Pleno para se juntar ao nosso time de dados. Você será responsável por projetar, construir e manter pipelines de dados robustos e escaláveis, utilizando um stack moderno de ferramentas open source. Trabalho remoto de qualquer lugar do Brasil, com equipe baseada em Porto Alegre.
Responsabilidades
- Projetar e implementar pipelines de dados usando Python e orquestradores como Dagster, Airflow ou Prefect.
- Modelar e transformar dados com dbt em warehouses como ClickHouse e PostgreSQL.
- Gerenciar dados em formato aberto como Apache Iceberg e Delta Lake, utilizando DuckDB e PyArrow para processamento.
- Implementar validações de qualidade de dados com Great Expectations e Soda.
- Colaborar com analistas e cientistas de dados para garantir a disponibilidade e confiabilidade dos dados.
Requisitos
- Experiência comprovada em engenharia de dados (nível pleno).
- Domínio de Python e bibliotecas como pandas, PyArrow, Pydantic e SQLAlchemy.
- Conhecimento de pelo menos um orquestrador de pipelines (Dagster, Airflow, Prefect).
- Experiência com dbt e modelagem de dados.
- Familiaridade com bancos de dados relacionais (PostgreSQL, Amazon Aurora) e colunares (ClickHouse).
- Conhecimento de formatos de dados abertos como Apache Parquet, Iceberg e Delta Lake.
- Noção de boas práticas de qualidade de dados (Great Expectations, Soda).
Diferenciais
- Experiência com DuckDB e processamento analítico local.
- Conhecimento de infraestrutura em nuvem (AWS, GCP, Azure).
- Contribuições para projetos open source.
Benefícios
- Remuneração compatível com o mercado.
- Trabalho remoto flexível.
- Vale-alimentação ou refeição.
- Plano de saúde e odontológico.
- Incentivo à educação e certificações.