← voltar para vagas
// vaga nova · acesso antecipado (48h) · empresa e link abrem quando completar 48h
sênior em ciência de dados
Sobre a vaga
O time de dados está em busca de uma pessoa sênior para ajudar a transformar grandes volumes de dados em decisões de negócio. Aqui você vai atuar com o que há de mais moderno em engenharia de dados e machine learning, desde pipelines escaláveis até sistemas de RAG com LLMs.
Responsabilidades
- Desenvolver e manter pipelines de dados usando PySpark, Databricks e Delta Lake
- Criar modelos preditivos e generativos com Scikit-Learn, TensorFlow, PyTorch e frameworks de LLM (LangChain, LangGraph, LlamaIndex)
- Implementar sistemas de embeddings e recuperação (RAG) para aplicações de busca e recomendação
- Trabalhar em estreita colaboração com times de produto e engenharia para definir métricas e experimentos
- Garantir a qualidade e governança dos dados com Unity Catalog e boas práticas de versionamento
Requisitos
- Experiência sólida em Python e SQL
- Domínio de PySpark e Databricks (Jobs, Workflows)
- Conhecimento prático de MLflow para experimentação e deploy
- Experiência com frameworks de Deep Learning (TensorFlow ou PyTorch)
- Familiaridade com LLMs, embeddings e RAG
- Capacidade de comunicar resultados técnicos para audiências não técnicas
Diferenciais
- Experiência com LangChain, LangGraph ou LlamaIndex
- Conhecimento de Delta Lake e Unity Catalog
- Já trabalhou com dados financeiros ou em fintechs
Benefícios
- Remoto de qualquer lugar do Brasil
- Vale alimentação ou refeição
- Plano de saúde e odontológico
- Participação nos lucros
- Horário flexível
Se você curte dados, quer resolver problemas reais e tem autonomia para tocar projetos do começo ao fim, essa vaga pode ser o seu próximo passo.