- Híbrido 2x por semana em Pinheiros
Estamos em busca de um(a) Cientista de Dados Sênior para atuar no desenvolvimento de soluções analíticas e modelos de Machine Learning com alto impacto para o negócio. Procuramos um profissional com forte capacidade técnica, experiência em ambientes de dados de larga escala e atuação end-to-end em projetos de IA, desde a concepção até a operação em produção.
Responsabilidades:
• Desenvolver scripts, automações e pipelines de dados utilizando Python, PySpark e SQL;
• Modernizar processos legados relacionados à gestão de dados, regras de negócio e motores analíticos;
• Projetar, desenvolver e implantar modelos de Machine Learning em ambientes produtivos;
• Atuar em todo o ciclo de vida dos modelos, incluindo exploração de dados, engenharia de atributos, treinamento, validação, deploy e monitoramento;
• Desenvolver soluções analíticas para desafios de negócio, com foco inicial em prevenção à fraude;
• Trabalhar com grandes volumes de dados em ambientes distribuídos;
• Construir e sustentar pipelines robustos para suportar processos analíticos e modelos preditivos;
• Monitorar continuamente a performance dos modelos em produção e propor melhorias;
• Documentar decisões técnicas, experimentos, automações e soluções desenvolvidas;
• Garantir reprodutibilidade, auditabilidade e governança das iniciativas de Ciência de Dados;
• Atuar como referência técnica para o time, realizando mentorias e compartilhando boas práticas;
• Contribuir para a evolução dos padrões de Machine Learning, Engenharia de Dados e Data Science;
• Colaborar com áreas de negócio e tecnologia na identificação de oportunidades de geração de valor.
Requisitos:
• Experiência sólida como Cientista de Dados Sênior atuando em projetos de IA e Machine Learning de ponta a ponta;
• Forte domínio de Python aplicado à Ciência de Dados, automação e desenvolvimento de pipelines;
• Experiência prática com pipelines de Machine Learning, versionamento de modelos e reprodutibilidade;
• Vivência com monitoramento de modelos, gestão de drift e acompanhamento de performance;
• Experiência com grandes volumes de dados e processamento distribuído utilizando PySpark;
• Capacidade de atuar com autonomia e ownership técnico das soluções;
• Experiência na modernização e automação de processos legados;
• Conhecimento avançado em SQL;
• Boa comunicação para interação com áreas técnicas e de negócio;
• Inglês avançado para participação em reuniões e alinhamentos internacionais;
• Formação superior em Ciência da Computação, Engenharia de Dados ou áreas correlatas.
Diferenciais:
• Experiência em modelos de prevenção e detecção de fraude;
• Vivência em ambientes regulados ou com dados sensíveis;
• Atuação prévia como mentor técnico hands-on;
• Experiência em iniciativas de Inteligência Artificial e transformação digital.
📩 Interessados(as), candidatem-se ou compartilhem esta oportunidade com sua rede!