SOBRE OS PROJETOS
As posições atuam em projetos de Pesquisa, Desenvolvimento e Inovação (PDI) , que combinam pesquisa aplicada, engenharia e desenvolvimento de software em ambientes de alta complexidade tecnológica — como microeletrônica, semicondutores, simulação de processos, dados e inteligência artificial. Os projetos envolvem times multidisciplinares, infraestrutura própria e em nuvem e cooperação com parceiros nacionais e internacionais. O ambiente tecnológico do Instituto é baseado no ecossistema Microsoft, com desenvolvimento web, práticas de DevOps, uso aplicado de inteligência artificial e gestão em metodologias ágeis.
RESUMO DA POSIÇÃO
Profissional responsável por especificar, desenhar e apoiar a implementação de arquiteturas de dados
(pipelines, data lakes e warehouses) que sustentam os projetos. Atua predominantemente na plataforma Microsoft Azure, em ambiente híbrido, colaborando na estruturação de dados, na garantia de governança e na disponibilização de bases para modelos de IA, sistemas e painéis analíticos.
PRINCIPAIS RESPONSABILIDADES
• Desenho e modelagem: especificar e desenhar arquiteturas de dados (data lake, data warehouse,
lakehouse) aplicando conceitos de modelagem relacional SQL, dimensional e NoSQL.
• Pipelines de dados: construir e manter pipelines de ingestão, transformação e orquestração de dados
(ETL/ELT).
• Estruturação para ML: colaborar com cientistas de dados na organização de dados estruturados e não
estruturados para treinamento e inferência de modelos.
• Governança e linhagem: aplicar padrões de nomenclatura, catálogo de dados, políticas de segurança,
controle de acesso e conformidade (LGPD).
• Documentação e suporte: documentar dicionários de dados, arquiteturas e fluxos de linhagem (data
lineage), dando suporte técnico ao time de desenvolvimento.
• Uso de ferramentas de IA: utilizar ferramentas de inteligência artificial no dia a dia como apoio à
automação de modelagem, à documentação e à qualidade de dados.
Modalidade de trabalho 1x (Híbrido) — segunda a sexta, horário comercial
Vila Olímpia
REQUISITOS OBRIGATÓRIOS
• Graduação em Ciência da Computação, Engenharia, Estatística, Sistemas de Informação ou áreas
correlatas.
• Experiência técnica consolidada em engenharia e arquitetura de dados em nível pleno (referência de 4
a 6 anos), participando ativamente do desenho e da construção de soluções.
• Domínio de modelagem de dados (relacional e dimensional) e uso fluente de SQL e Python.
• Experiência com nuvem Microsoft Azure (Azure Data Lake, Azure Synapse Analytics/SQL Database) e
orquestração (Azure Data Factory, Airflow ou dbt).
• Conhecimento de processamento distribuído (Spark, Databricks).
• Noções de governança de dados, rastreabilidade, LGPD e práticas de versionamento com Git.
• Uso de ferramentas de inteligência artificial como apoio ao trabalho técnico do dia a dia.
• Modalidade: disponibilidade para contratação PJ, modalidade híbrida, de segunda a sexta.
• Idioma: inglês técnico para leitura de documentação.
DIFERENCIAIS
• Experiência em projetos de P&D, dados científicos e experimentais, IoT ou indústria de eletrônicos e
semicondutores.
• Certificações na nuvem Microsoft (ex.: Azure Data Engineer Associate).
• Conhecimento de arquiteturas de dados para machine learning (MLOps) e de ecossistemas híbridos
(on-premise + nuvem).
• Inglês acima de intermediário (avançado), para comunicação com parceiros e fornecedores
internacionais.
COMPETÊNCIAS COMPORTAMENTAIS
• Pensamento analítico focado em organização e estrutura de dados.
• Boa comunicação e postura colaborativa com desenvolvedores, cientistas de dados e pesquisadores.
• Pragmatismo para propor soluções viáveis e adaptáveis a projetos de inovação.
• Vontade de aprender e de compartilhar conhecimento com o time.
• Curiosidade e disposição para experimentar novas abordagens e ferramentas.