La Capa de Conocimiento Se Convirtió en el Cuello de Botella de los Agentes
Todo dev que construye agentes a escala eventualmente choca con la misma pared: la lógica del agente es directa, pero la infraestructura de conocimiento debajo es engañosamente compleja. Agentes en producción exigen estabilidad, escala, acceso a datos, calidad de respuesta, seguridad e ingesta de contenido — todo al mismo tiempo.
Microsoft Foundry IQ, anunciado en Build 2026, ataca este problema directamente. Es una plataforma de conocimiento empresarial que conecta agentes a la inteligencia colectiva de tu empresa: documentos, emails, reuniones, datos operativos y contenido web en vivo. La plataforma ahora está en GA con varias actualizaciones importantes.
Vamos a ver qué cambió y qué significa para tu arquitectura de agentes.

Lo Nuevo: GA, Serverless y MCP
Knowledge Bases Ahora en GA
El núcleo de knowledge bases llegó a GA con SLA completo, certificaciones de compliance y APIs estables. Esto incluye el servidor MCP de Foundry IQ, que expone knowledge bases como un servidor MCP remoto, compatible con Claude, ChatGPT, LangChain y el Microsoft Agent Framework.
# Ejemplo: Conectando al servidor MCP de Foundry IQ desde Python
# 예시: Python에서 Foundry IQ MCP 서버에 연결하기
import asyncio
from mcp import ClientSession, StdioServerParameters
from mcp.client.stdio import stdio_client
async def consultar_foundry_iq(consulta: str, kb_id: str):
"""Consulta una knowledge base de Foundry IQ vía MCP"""
params = StdioServerParameters(
command="npx",
args=["-y", "@foundry/iq-mcp-server"],
env={
"FOUNDRY_IQ_ENDPOINT": "https://tu-servicio.search.windows.net",
"FOUNDRY_IQ_API_KEY": "tu-api-key",
"FOUNDRY_IQ_KB_ID": kb_id
}
)
async with stdio_client(params) as (read, write):
async with ClientSession(read, write) as session:
await session.initialize()
# Realiza retrieval agentico
resultado = await session.call_tool(
"retrieve_agentic",
arguments={
"query": consulta,
"reasoning_effort": "minimal",
"top_k": 10
}
)
return resultado
# Uso
# resultado = asyncio.run(consultar_foundry_iq("¿Cuál fue el ingreso del Q3?", "kb-123"))
Tier Serverless: Precio Escala a Cero
Los workloads de agentes son bursty por naturaleza — cientos de pasos en segundos, luego horas ociosas. El nuevo Foundry IQ Serverless (tier Developer, preview público) elimina gestión de clusters y costos ociosos. La facturación comienza el 13 de septiembre de 2026.
| Capacidad | Unidad de Medida |
|---|---|
| Uso de cómputo | CU / hora |
| Almacenamiento indexado | GB / mes |
| Índices por servicio | 30 índices / servicio |
| Servicios por suscripción por región | 5 servicios / región |
Precios regionales (CU/hora / GB-mes):
- West Central US: $0.288 / $0.239
- Switzerland North: $0.343 / $0.286
- Japan East: $0.290 / $0.289
Nuevas Fuentes de Conocimiento en Preview
- Work IQ: Emails, reuniones, archivos, mensajes de Teams — respetando permisos de usuario
- Fabric IQ: Consulta a data agents y ontologías de la empresa (capa semántica de OneLake)
- File Search: Upload directo de archivos
- Azure SQL: Datos relacionales estructurados
- MCP Server: Cualquier conocimiento servido vía Model Context Protocol

Retrieval Agentico: 54% Más Recall, Menos Tokens
El loop de retrieval agentico de Foundry IQ ahora agrupa queries más eficientemente, usa ranking semántico para mejorar la selección de pasajes y aplica cache de tokens en el servidor. Los resultados son impresionantes:
- Calidad de respuesta mejoró hasta 20% en los datasets evaluados
- Recall mejoró hasta 54% comparado a RAG de disparo único
- Significativamente menos tokens gastados sin pérdida de calidad
Actualizaciones de Seguridad y Pipeline de Datos
Varias capacidades de seguridad están en preview: customer-managed keys (CMK) cross-tenant con identidad federada, auditoría de sensitivity labels de Purview, sync incremental de permisos de SharePoint y soporte a APIM. Conectividad privada vía Shared Private Link y Network Security Perimeter está en GA.
Mejoras en el pipeline de datos incluyen ingesta layout-aware que convierte diagramas, gráficos e imágenes escaneadas en texto significativo — para que los agentes estén fundamentados en documentos completos, no solo texto crudo.

Limitaciones y Puntos de Atención
- Serverless es solo preview: El tier Developer está en preview público. Workloads serverless de producción necesitan esperar al GA con precios y SLAs.
- Fecha de facturación fija: Si provisionas recursos serverless ahora, bórralos antes del 13 de septiembre de 2026 para evitar cobros.
- Límites de índice: 30 índices por servicio y 5 servicios por suscripción por región — planifica tu arquitectura multi-tenant.
- MCP aún está evolucionando: Aunque el servidor MCP funciona con Claude y ChatGPT, el ecosistema MCP es joven. Prueba los caminos de integración con cuidado.
Resumen: Construye Una Vez, Reutiliza en Todos Lados
El GA de Foundry IQ marca un paso significativo hacia la estandarización de la capa de conocimiento empresarial. El servidor MCP es la pieza más interesante — desacopla la infraestructura de conocimiento de cualquier framework de agente específico, que es exactamente lo que el ecosistema necesita.
Próximos pasos para tu aprendizaje:
- Empieza con el Mastering Foundry IQ cookbook para construir con el servidor MCP
- Experimenta con el tier serverless para workloads bursty
- Evalúa la calidad del retrieval agentico contra tu propio baseline de RAG
- Revisa los previews de seguridad (CMK, labels de Purview) para tus requisitos de compliance
Para contexto más amplio sobre cómo las disrupciones de infraestructura afectan deploys de IA, checa este análisis sobre disrupciones de internet en Q1 2026 e impacto en servicios cloud. También, si estás explorando el lado GPU de la infraestructura de IA, nuestra cobertura sobre CUDA 13.3 con Tile C++ y compilador auto-tuning vale la pena.
Recursos relacionados: