Guía técnica

Arquitectura de agentes de IA: componentes de flujos fiables

2026-09-02·Lectura de unos 11 minutos·Actualizado el 2026-09-02

La arquitectura de agentes de IA es el software que rodea a un modelo: estado, recuperación, herramientas, orquestación, seguridad y evaluación. Una buena arquitectura hace visibles la incertidumbre y los fallos en lugar de ocultarlos detrás de una interfaz conversacional.

Investigación y transparencia: Las recomendaciones de arquitectura se basan en la documentación oficial de OpenAI, Anthropic, LangChain, NISTconsultada el 2 de septiembre de 2026.

Capas de referencia

CapaResponsabilidadPregunta de diseño
InterfazRecibe objetivos y muestra el estado¿Qué debe aprobar el usuario?
OrquestadorControla pasos, reintentos y paradas¿Se puede registrar cada transición?
ModeloInterpreta contexto y propone acciones¿Qué esquema de salida se necesita?
ContextoRecupera archivos, memoria y estado¿Se aplican permisos antes de recuperar?
HerramientasEjecutan acciones externas¿Las llamadas están limitadas y son idempotentes?
EvaluaciónMide calidad y seguridad¿Qué fallos bloquean el lanzamiento?

Estado y memoria

Separa el estado temporal de una ejecución de la memoria duradera del proyecto. Guarda procedencia y fecha junto a los datos recuperados. No trates una respuesta anterior del modelo como memoria oficial sin una política de revisión y fuentes.

Para distinguir arquitectura y flujo, consulta la [guía de flujo de trabajo agéntico](https://ottermind.ai/blog/what-is-an-agentic-flujo de trabajo): la arquitectura describe los límites del sistema y el flujo describe el trabajo ordenado que ejecuta.

Límites de las herramientas

Expón funciones limitadas en lugar de credenciales sin restricciones. Valida los argumentos, define tiempos de espera y exige confirmación para enviar, eliminar, comprar o modificar permisos. Usa claves de idempotencia para que los reintentos no dupliquen efectos.

Recuperación y grounding

Recupera solo contenido al que el usuario tenga acceso. Incluye identificadores de fuente en el contexto y exige citas o campos de evidencia en la salida. Si la recuperación está vacía o hay conflicto, devuelve un estado de escalado en vez de inventar una respuesta.

Empieza por una parte reversible

Prueba una tarea de lectura antes de permitir escrituras. Un informe basado en fuentes o una clasificación produce trazas útiles sin riesgo irreversible. Añade una herramienta cada vez y registra su límite de permisos.

Contratos de solicitud y respuesta

Define un contrato entre cada capa. La solicitud debe incluir objetivo, identidad, fuentes permitidas y presupuesto; la respuesta debe incluir estado, salida estructurada, citas, llamadas a herramientas y elementos pendientes de revisión.

Prompt
{
  "status": "needs_review",
  "claims": [],
  "sources": [],
  "open_questions": ["El conjunto aprobado no contiene el trimestre más reciente."]
}

Un estado explícito es más seguro que un párrafo fluido que oculta la ausencia de una fuente.

Evaluación y operaciones

Crea casos normales, incompletos, adversarios y multilingües. Sigue errores de herramientas, tasa de escalado, latencia, coste y correcciones de revisores. Versiona prompts, herramientas, ajustes del modelo y políticas juntos.

Lista para producción

  • Trazas reproducibles para cada llamada y versión del modelo
  • Credenciales y datos separados entre pruebas y producción
  • Escrituras idempotentes y ruta de rollback documentada
  • Casos de evaluación antes de cada cambio de prompt o modelo
  • Una persona responsable de escalados e incidentes

Ejecución síncrona, asíncrona y aprobación humana

La clasificación breve puede ser síncrona. La recuperación larga o la generación de documentos debe ser asíncrona, con progreso y cancelación. Coloca aprobación humana antes de acciones irreversibles y cuando fallen la confianza, los permisos o las políticas. Guarda la decisión para que un reintento conserve el contexto.

Presupuestos de coste y latencia

Define un máximo de turnos del modelo, llamadas a herramientas, tokens y tiempo. Usa un modelo menor para extracción sencilla y reserva el razonamiento costoso para casos ambiguos. El presupuesto controla la operación e indica cuándo el flujo se detendrá para pedir ayuda.

Preguntas frecuentes

¿Necesito una arquitectura multiagente?

No. Empieza con un agente y herramientas explícitas. Añade agentes solo cuando los roles, permisos o criterios de evaluación sean realmente distintos.

¿Dónde debe estar la seguridad?

En todas las capas: identidad, recuperación, permisos, secretos, registros y aprobación humana. No es una tarea final.

¿Cómo reduzco las alucinaciones?

Mejora las fuentes, limita la salida, exige evidencias y convierte la incertidumbre en una acción de revisión. El prompt por sí solo no basta.

¿Qué prototipo primero?

Un flujo limitado y reversible con un revisor identificado. Valida el camino de control antes de añadir herramientas.

Descarga la app de escritorio y móvil

Accede a Ottermind en cualquier momento y lugar.

Ordenador