Nosso cliente é uma unidade de Pesquisa & Desenvolvimento pertencente a um grande grupo multinacional.
Você será responsável por desenhar a arquitetura de sistemas agênticos de alta complexidade na uma plataforma de busca conversacional de veículos, garantindo que os agentes não apenas funcionem, mas sejam resilientes, seguros e otimizados financeiramente em produção.
Responsabilidades:
- Arquitetura Agêntica Avançada: Projetar e evoluir fluxos de trabalho complexos sobre o Google Agent Development Kit (ADK) - skills/tools especializados (exploração, comparação, decisão, análise de inventário), sessão e estado do agente, e memória de longo prazo via RAG (embeddings + busca vetorial) - definindo padrões de comunicação e estado entre componentes.
- Otimização e Escala: Liderar iniciativas de melhoria de latência e redução de custos de inferência (tokens) usando modelos Gemini via Vertex AI, otimizando engenharia de prompt, streaming (SSE) e estratégias de caching.
- Arquitetura de Dados: Desenhar fluxos de dados que alimentam os agentes - persistência de sessão e domínio em DynamoDB (single-table design) e memória vetorial em OpenSearch - visando maior precisão, performance e confiabilidade das soluções.
- Execução Segura de Código: Projetar e manter integrações de sandboxing para execução de código gerado por agentes (Amazon Bedrock AgentCore Code Interpreter), com foco em isolamento e segurança.
- Governança de Observabilidade: Definir os KPIs técnicos de qualidade dos agentes (ex: hallucination rate, faithfulness, aderência a guardrails) e configurar dashboards, alertas críticos e pipelines de avaliação (LLM-as-a-judge) no Datadog LLM Observability.
- Segurança e Guardrails: Implementar e evoluir guardrails de entrada/saída, redação de PII e políticas de acesso, seguindo boas práticas de segurança para sistemas de IA em produção.
- Mentoria Técnica: Atuar como referência para desenvolvedores Plenos e Juniores, realizando code reviews rigorosos focados em segurança e clean architecture para IA.