A Camada de Conhecimento Virou o Gargalo dos Agentes
Todo dev que constrói agentes em escala eventualmente bate na mesma parede: a lógica do agente é simples, mas a infraestrutura de conhecimento por baixo é enganosamente complexa. Agentes em produção exigem estabilidade, escala, acesso a dados, qualidade de resposta, segurança e ingestão de conteúdo — tudo ao mesmo tempo.
O Microsoft Foundry IQ, anunciado no Build 2026, ataca esse problema diretamente. É uma plataforma de conhecimento empresarial que conecta agentes à inteligência coletiva da sua empresa: documentos, emails, reuniões, dados operacionais e conteúdo web ao vivo. A plataforma agora está em GA com várias atualizações importantes.
Vamos ver o que mudou e o que isso significa para sua arquitetura de agentes.

O Que Há de Novo: GA, Serverless e MCP
Knowledge Bases Agora Estão em GA
O núcleo de knowledge bases chegou ao GA com SLA completo, certificações de compliance e APIs estáveis. Isso inclui o servidor MCP do Foundry IQ, que expõe knowledge bases como um servidor MCP remoto, compatível com Claude, ChatGPT, LangChain e o Microsoft Agent Framework.
# Exemplo: Conectando ao servidor MCP do Foundry IQ em Python
# 예시: Python에서 Foundry IQ MCP 서버에 연결하기
import asyncio
from mcp import ClientSession, StdioServerParameters
from mcp.client.stdio import stdio_client
async def consultar_foundry_iq(consulta: str, kb_id: str):
"""Consulta uma knowledge base do Foundry IQ via MCP"""
params = StdioServerParameters(
command="npx",
args=["-y", "@foundry/iq-mcp-server"],
env={
"FOUNDRY_IQ_ENDPOINT": "https://seu-servico.search.windows.net",
"FOUNDRY_IQ_API_KEY": "sua-chave-api",
"FOUNDRY_IQ_KB_ID": kb_id
}
)
async with stdio_client(params) as (read, write):
async with ClientSession(read, write) as session:
await session.initialize()
# Realiza retrieval agentico
resultado = await session.call_tool(
"retrieve_agentic",
arguments={
"query": consulta,
"reasoning_effort": "minimal",
"top_k": 10
}
)
return resultado
# Uso
# resultado = asyncio.run(consultar_foundry_iq("Qual foi a receita do Q3?", "kb-123"))
Tier Serverless: Preço Escala a Zero
Workloads de agentes são bursty por natureza — centenas de passos em segundos, depois horas ociosas. O novo Foundry IQ Serverless (tier Developer, preview público) elimina gerenciamento de cluster e custos ociosos. A cobrança começa em 13 de setembro de 2026.
| Capacidade | Unidade de Medida |
|---|---|
| Uso de computação | CU / hora |
| Armazenamento indexado | GB / mês |
| Índices por serviço | 30 índices / serviço |
| Serviços por assinatura por região | 5 serviços / região |
Preços regionais (CU/hora / GB-mês):
- West Central US: $0.288 / $0.239
- Switzerland North: $0.343 / $0.286
- Japan East: $0.290 / $0.289
Novas Fontes de Conhecimento em Preview
- Work IQ: Emails, reuniões, arquivos, mensagens do Teams — respeitando permissões de usuário
- Fabric IQ: Consulta a data agents e ontologias da empresa (camada semântica do OneLake)
- File Search: Upload direto de arquivos
- Azure SQL: Dados relacionais estruturados
- MCP Server: Qualquer conhecimento servido via Model Context Protocol

Retrieval Agentico: 54% Mais Recall, Menos Tokens
O loop de retrieval agentico do Foundry IQ agora faz batch de queries de forma mais eficiente, usa ranking semântico para melhorar a seleção de passagens e aplica cache de tokens no servidor. Os resultados são impressionantes:
- Qualidade de resposta melhorou até 20% nos datasets avaliados
- Recall melhorou até 54% comparado a RAG de disparo único
- Significativamente menos tokens gastos sem perda de qualidade
Atualizações de Segurança e Pipeline de Dados
Várias capacidades de segurança estão em preview: customer-managed keys (CMK) cross-tenant com identidade federada, auditoria de sensitivity labels do Purview, sync incremental de permissões do SharePoint e suporte a APIM. Conectividade privada via Shared Private Link e Network Security Perimeter está em GA.
Melhorias no pipeline de dados incluem ingestão layout-aware que converte diagramas, gráficos e imagens escaneadas em texto significativo — para que agentes sejam fundamentados em documentos completos, não apenas texto cru.

Limitações e Pontos de Atenção
- Serverless é só preview: O tier Developer está em preview público. Workloads serverless de produção precisam esperar o GA com preços e SLAs.
- Data de cobrança fixa: Se provisionar recursos serverless agora, delete antes de 13 de setembro de 2026 para evitar cobranças.
- Limites de índice: 30 índices por serviço e 5 serviços por assinatura por região — planeje sua arquitetura multi-tenant.
- MCP ainda está evoluindo: Embora o servidor MCP funcione com Claude e ChatGPT, o ecossistema MCP é jovem. Teste os caminhos de integração com cuidado.
Resumo: Construa Uma Vez, Reutilize em Todo Lugar
O GA do Foundry IQ marca um passo significativo para padronizar a camada de conhecimento empresarial. O servidor MCP é a peça mais interessante — ele desacopla a infraestrutura de conhecimento de qualquer framework de agente específico, que é exatamente o que o ecossistema precisa.
Próximos passos para seu aprendizado:
- Comece com o Mastering Foundry IQ cookbook para construir com o servidor MCP
- Experimente o tier serverless para workloads bursty
- Avalie a qualidade do retrieval agentico contra seu próprio baseline de RAG
- Revise os previews de segurança (CMK, labels do Purview) para seus requisitos de compliance
Para contexto mais amplo sobre como disrupções de infraestrutura afetam deploys de IA, veja esta análise sobre disrupções de internet no Q1 2026 e impacto em serviços cloud. Também, se você está explorando o lado GPU da infraestrutura de IA, nossa cobertura sobre CUDA 13.3 com Tile C++ e compilador auto-tuning vale a leitura.
Recursos relacionados: