← voltar para vagas
// vaga nova · acesso antecipado (48h) · empresa e link abrem quando completar 48h

cientista de dados sênior

@ ██████ · ·REMOTO · SÃO PAULO, SÃO PAULO, BRASIL

Sobre a vaga

Estamos em busca de uma pessoa Cientista de Dados Sênior para atuar em projetos desafiadores, aplicando técnicas avançadas de machine learning e inteligência artificial. O foco será a construção de soluções de dados escaláveis, com ênfase em modelos de linguagem (LLMs), sistemas de recuperação aumentada (RAG) e pipelines de MLOps.

Responsabilidades

  • Desenvolver e implementar modelos preditivos e generativos utilizando Python, pandas, NumPy e scikit-learn
  • Construir pipelines de CI/CD para deploy de modelos em ambientes produtivos
  • Trabalhar com APIs e integrações de dados
  • Utilizar plataformas como SageMaker e Databricks para orquestração de experimentos e deploy
  • Explorar e aplicar técnicas de embeddings, vector databases e RAG para melhorar sistemas de busca e recomendação
  • Colaborar com times de engenharia e produto para alinhar soluções de dados aos objetivos de negócio

Requisitos

  • Experiência sólida com Python, pandas, NumPy e scikit-learn
  • Conhecimento em machine learning e deep learning
  • Experiência com MLOps: versionamento de modelos, CI/CD e deploy
  • Familiaridade com LLMs, RAG, embeddings e vector databases
  • Conhecimento em Git, APIs e integração de dados
  • Experiência com SageMaker, Databricks ou plataformas similares

Diferenciais

  • Experiência com bancos de dados vetoriais (ex: Pinecone, Weaviate)
  • Conhecimento em frameworks como LangChain ou LlamaIndex
  • Publicações ou contribuições em projetos open source de dados

Benefícios

  • Remuneração compatível com o mercado sênior
  • Horário flexível e trabalho remoto
  • Plano de saúde e odontológico
  • Vale-refeição ou alimentação
  • Incentivo à educação e certificações