← voltar para vagas
// vaga nova · acesso antecipado (48h) · empresa e link abrem quando completar 48h

sênior em ciência de dados

@ █████ · ·REMOTO · REMOTO (BRASIL)

Sobre a vaga

O time de dados está em busca de uma pessoa sênior para ajudar a transformar grandes volumes de dados em decisões de negócio. Aqui você vai atuar com o que há de mais moderno em engenharia de dados e machine learning, desde pipelines escaláveis até sistemas de RAG com LLMs.

Responsabilidades

  • Desenvolver e manter pipelines de dados usando PySpark, Databricks e Delta Lake
  • Criar modelos preditivos e generativos com Scikit-Learn, TensorFlow, PyTorch e frameworks de LLM (LangChain, LangGraph, LlamaIndex)
  • Implementar sistemas de embeddings e recuperação (RAG) para aplicações de busca e recomendação
  • Trabalhar em estreita colaboração com times de produto e engenharia para definir métricas e experimentos
  • Garantir a qualidade e governança dos dados com Unity Catalog e boas práticas de versionamento

Requisitos

  • Experiência sólida em Python e SQL
  • Domínio de PySpark e Databricks (Jobs, Workflows)
  • Conhecimento prático de MLflow para experimentação e deploy
  • Experiência com frameworks de Deep Learning (TensorFlow ou PyTorch)
  • Familiaridade com LLMs, embeddings e RAG
  • Capacidade de comunicar resultados técnicos para audiências não técnicas

Diferenciais

  • Experiência com LangChain, LangGraph ou LlamaIndex
  • Conhecimento de Delta Lake e Unity Catalog
  • Já trabalhou com dados financeiros ou em fintechs

Benefícios

  • Remoto de qualquer lugar do Brasil
  • Vale alimentação ou refeição
  • Plano de saúde e odontológico
  • Participação nos lucros
  • Horário flexível

Se você curte dados, quer resolver problemas reais e tem autonomia para tocar projetos do começo ao fim, essa vaga pode ser o seu próximo passo.