A Camada de Conhecimento Virou o Gargalo dos Agentes

Todo dev que constrói agentes em escala eventualmente bate na mesma parede: a lógica do agente é simples, mas a infraestrutura de conhecimento por baixo é enganosamente complexa. Agentes em produção exigem estabilidade, escala, acesso a dados, qualidade de resposta, segurança e ingestão de conteúdo — tudo ao mesmo tempo.

O Microsoft Foundry IQ, anunciado no Build 2026, ataca esse problema diretamente. É uma plataforma de conhecimento empresarial que conecta agentes à inteligência coletiva da sua empresa: documentos, emails, reuniões, dados operacionais e conteúdo web ao vivo. A plataforma agora está em GA com várias atualizações importantes.

Vamos ver o que mudou e o que isso significa para sua arquitetura de agentes.

Microsoft Foundry IQ cloud infrastructure connecting multiple enterprise data sources for agentic AI retrieval Algorithm Concept Visual

O Que Há de Novo: GA, Serverless e MCP

Knowledge Bases Agora Estão em GA

O núcleo de knowledge bases chegou ao GA com SLA completo, certificações de compliance e APIs estáveis. Isso inclui o servidor MCP do Foundry IQ, que expõe knowledge bases como um servidor MCP remoto, compatível com Claude, ChatGPT, LangChain e o Microsoft Agent Framework.

# Exemplo: Conectando ao servidor MCP do Foundry IQ em Python
# 예시: Python에서 Foundry IQ MCP 서버에 연결하기

import asyncio
from mcp import ClientSession, StdioServerParameters
from mcp.client.stdio import stdio_client

async def consultar_foundry_iq(consulta: str, kb_id: str):
    """Consulta uma knowledge base do Foundry IQ via MCP"""
    params = StdioServerParameters(
        command="npx",
        args=["-y", "@foundry/iq-mcp-server"],
        env={
            "FOUNDRY_IQ_ENDPOINT": "https://seu-servico.search.windows.net",
            "FOUNDRY_IQ_API_KEY": "sua-chave-api",
            "FOUNDRY_IQ_KB_ID": kb_id
        }
    )
    
    async with stdio_client(params) as (read, write):
        async with ClientSession(read, write) as session:
            await session.initialize()
            
            # Realiza retrieval agentico
            resultado = await session.call_tool(
                "retrieve_agentic",
                arguments={
                    "query": consulta,
                    "reasoning_effort": "minimal",
                    "top_k": 10
                }
            )
            return resultado

# Uso
# resultado = asyncio.run(consultar_foundry_iq("Qual foi a receita do Q3?", "kb-123"))

Tier Serverless: Preço Escala a Zero

Workloads de agentes são bursty por natureza — centenas de passos em segundos, depois horas ociosas. O novo Foundry IQ Serverless (tier Developer, preview público) elimina gerenciamento de cluster e custos ociosos. A cobrança começa em 13 de setembro de 2026.

CapacidadeUnidade de Medida
Uso de computaçãoCU / hora
Armazenamento indexadoGB / mês
Índices por serviço30 índices / serviço
Serviços por assinatura por região5 serviços / região

Preços regionais (CU/hora / GB-mês):

  • West Central US: $0.288 / $0.239
  • Switzerland North: $0.343 / $0.286
  • Japan East: $0.290 / $0.289

Novas Fontes de Conhecimento em Preview

  • Work IQ: Emails, reuniões, arquivos, mensagens do Teams — respeitando permissões de usuário
  • Fabric IQ: Consulta a data agents e ontologias da empresa (camada semântica do OneLake)
  • File Search: Upload direto de arquivos
  • Azure SQL: Dados relacionais estruturados
  • MCP Server: Qualquer conhecimento servido via Model Context Protocol

Developer configuring Foundry IQ MCP server to connect AI agents with enterprise knowledge bases Development Concept Image

Retrieval Agentico: 54% Mais Recall, Menos Tokens

O loop de retrieval agentico do Foundry IQ agora faz batch de queries de forma mais eficiente, usa ranking semântico para melhorar a seleção de passagens e aplica cache de tokens no servidor. Os resultados são impressionantes:

  • Qualidade de resposta melhorou até 20% nos datasets avaliados
  • Recall melhorou até 54% comparado a RAG de disparo único
  • Significativamente menos tokens gastos sem perda de qualidade

Atualizações de Segurança e Pipeline de Dados

Várias capacidades de segurança estão em preview: customer-managed keys (CMK) cross-tenant com identidade federada, auditoria de sensitivity labels do Purview, sync incremental de permissões do SharePoint e suporte a APIM. Conectividade privada via Shared Private Link e Network Security Perimeter está em GA.

Melhorias no pipeline de dados incluem ingestão layout-aware que converte diagramas, gráficos e imagens escaneadas em texto significativo — para que agentes sejam fundamentados em documentos completos, não apenas texto cru.

Dashboard showing Foundry IQ agentic retrieval performance metrics with token usage optimization charts System Abstract Visual

Limitações e Pontos de Atenção

  1. Serverless é só preview: O tier Developer está em preview público. Workloads serverless de produção precisam esperar o GA com preços e SLAs.
  2. Data de cobrança fixa: Se provisionar recursos serverless agora, delete antes de 13 de setembro de 2026 para evitar cobranças.
  3. Limites de índice: 30 índices por serviço e 5 serviços por assinatura por região — planeje sua arquitetura multi-tenant.
  4. MCP ainda está evoluindo: Embora o servidor MCP funcione com Claude e ChatGPT, o ecossistema MCP é jovem. Teste os caminhos de integração com cuidado.

Resumo: Construa Uma Vez, Reutilize em Todo Lugar

O GA do Foundry IQ marca um passo significativo para padronizar a camada de conhecimento empresarial. O servidor MCP é a peça mais interessante — ele desacopla a infraestrutura de conhecimento de qualquer framework de agente específico, que é exatamente o que o ecossistema precisa.

Próximos passos para seu aprendizado:

  1. Comece com o Mastering Foundry IQ cookbook para construir com o servidor MCP
  2. Experimente o tier serverless para workloads bursty
  3. Avalie a qualidade do retrieval agentico contra seu próprio baseline de RAG
  4. Revise os previews de segurança (CMK, labels do Purview) para seus requisitos de compliance

Para contexto mais amplo sobre como disrupções de infraestrutura afetam deploys de IA, veja esta análise sobre disrupções de internet no Q1 2026 e impacto em serviços cloud. Também, se você está explorando o lado GPU da infraestrutura de IA, nossa cobertura sobre CUDA 13.3 com Tile C++ e compilador auto-tuning vale a leitura.

Recursos relacionados:

Este conteúdo foi elaborado com o auxílio de ferramentas de IA, com base em fontes confiáveis, e revisado pela nossa equipe editorial antes da publicação. Não substitui o aconselhamento de um profissional especializado.