Cientista de Dados Sênior

Curitiba Hybrid

Com mais de 40 anos de história, somos pioneiros e especialistas no segmento de empréstimos consignados. E também, em investimentos de renda fixa e variável com o Paraná Banco Investimentos.

Oferecemos empréstimos com segurança e transparência para quem deseja quitar dívidas maiores, investir em algo ou realizar um sonho. Com o propósito transformar soluções financeiras em sorrisos!

E o que nos torna especiais?

  • Somos apaixonados pelo sorriso: Buscamos as melhores experiências para os nossos clientes, valorizamos as pessoas e somos apaixonados pela empresa.
  • Somos inovadores e buscamos simplicidade: Testamos, aprendemos e pensamos sempre em melhorias contínuas.
  • Somos flexíveis e promovemos mudanças: Cultivamos a adaptabilidade como virtude, incentivando e promovendo constantes transformações para alcançar o melhor de cada jornada.
  • Somos guiados por dados: Os nossos objetivos são claros, se não podemos medir, não podemos fazer. Somos direcionados pela eficiência e aproveitamos ao máximo os recursos disponíveis.

Nossas vagas são destinadas à todas as pessoas! Sem distinção de gênero, raça, cor, idade, orientação sexual ou etnia.

 

Requirements

Responsabilidades e atribuições:
Desenvolver modelos analíticos, estatísticos e de Machine Learning para suportar decisões de negócio e gerar valor para a organização.
Realizar exploração, transformação e análise de grandes volumes de dados utilizando PySpark, SQL e Python.
Construir e otimizar pipelines de processamento de dados em ambientes distribuídos, com foco em performance e escalabilidade.
Desenvolver, validar, implantar e monitorar modelos de Machine Learning em ambiente produtivo.
Trabalhar em parceria com áreas de negócio para traduzir problemas complexos em soluções baseadas em dados.
Participar da definição de métricas, indicadores e estudos analíticos para acompanhamento de resultados.
Aplicar boas práticas de desenvolvimento, documentação e versionamento de código utilizando Git.
Contribuir para a evolução técnica do time e para a disseminação de boas práticas de Ciência de Dados.

Resultados esperados:
Entregar modelos e soluções analíticas que gerem impacto mensurável para o negócio.
Garantir a qualidade, confiabilidade e escalabilidade das soluções desenvolvidas.
Automatizar processos analíticos, reduzindo esforço operacional e acelerando a geração de insights.
Promover o uso eficiente dos dados por meio de análises robustas e bem documentadas.
Assegurar monitoramento, manutenção e evolução contínua dos modelos implantados em produção.

Requisitos obrigatórios:
Formação superior em áreas quantitativas, como Ciência da Computação, Estatística, Matemática, Engenharia ou correlatas.
Experiência sólida em Ciência de Dados e desenvolvimento de modelos analíticos.
Conhecimento avançado em Python, SQL e PySpark.
Experiência em manipulação, transformação e análise de grandes volumes de dados.
Conhecimento das principais bibliotecas do ecossistema Python para análise e modelagem, como: Pandas, NumPy, NumPy Financial, Scikit-Learn, entre outros.
Experiência com desenvolvimento colaborativo e versionamento utilizando Git.
Capacidade de comunicação com áreas técnicas e de negócio.

Requisitos desejáveis:

Experiência com Pyomo para modelagem e otimização matemática.
Conhecimento em MLflow para gestão do ciclo de vida de modelos de Machine Learning.
Experiência com Databricks e ecossistema Spark.
Vivência em implantação e monitoramento de modelos em produção.
Conhecimento de ambientes cloud e arquiteturas modernas de dados.
Experiência em projetos de otimização, pesquisa operacional ou modelagem matemática avançada.

 

Modelo de trabalho:

Colaboradores com domicilio em Curitiba e região metropolitana: Híbrido.
Colaboradores de outras localidades: Remoto.