← voltar para vagas
// vaga nova · acesso antecipado (48h) · empresa e link abrem quando completar 48h
cientista de dados sênior
Sobre a vaga
Estamos em busca de uma pessoa Cientista de Dados Sênior para atuar em projetos desafiadores, aplicando técnicas avançadas de machine learning e inteligência artificial. O foco será a construção de soluções de dados escaláveis, com ênfase em modelos de linguagem (LLMs), sistemas de recuperação aumentada (RAG) e pipelines de MLOps.
Responsabilidades
- Desenvolver e implementar modelos preditivos e generativos utilizando Python, pandas, NumPy e scikit-learn
- Construir pipelines de CI/CD para deploy de modelos em ambientes produtivos
- Trabalhar com APIs e integrações de dados
- Utilizar plataformas como SageMaker e Databricks para orquestração de experimentos e deploy
- Explorar e aplicar técnicas de embeddings, vector databases e RAG para melhorar sistemas de busca e recomendação
- Colaborar com times de engenharia e produto para alinhar soluções de dados aos objetivos de negócio
Requisitos
- Experiência sólida com Python, pandas, NumPy e scikit-learn
- Conhecimento em machine learning e deep learning
- Experiência com MLOps: versionamento de modelos, CI/CD e deploy
- Familiaridade com LLMs, RAG, embeddings e vector databases
- Conhecimento em Git, APIs e integração de dados
- Experiência com SageMaker, Databricks ou plataformas similares
Diferenciais
- Experiência com bancos de dados vetoriais (ex: Pinecone, Weaviate)
- Conhecimento em frameworks como LangChain ou LlamaIndex
- Publicações ou contribuições em projetos open source de dados
Benefícios
- Remuneração compatível com o mercado sênior
- Horário flexível e trabalho remoto
- Plano de saúde e odontológico
- Vale-refeição ou alimentação
- Incentivo à educação e certificações