Utilizar el marco de diseño de agentes

El marco de diseño de agentes proporciona un conjunto de elementos básicos que le guían para definir el propósito de su agente, incluyendo desencadenadores, herramientas, canales, requisitos de gobernanza y más. Este marco no es un modelo rígido, sino una herramienta para la reflexión que ayuda a que el equipo se alinee en las decisiones, identifique riesgos temprano y evite errores comunes.

Sugerencia

Este artículo se basa en los conceptos tratados en el siguiente vídeo. Para consultar un tutorial y contexto adicional, vea: Copilot Studio business canvas – Your blueprint for designing agents

Bloques del diseño de agentes

Utilice los siguientes bloques de construcción para describir completamente a su agente.

Sugerencia

Descargue el lienzo de diseño editable para planificar sus proyectos de agentes.

Captura de pantalla del lienzo de diseño de agentes mostrando secciones para desencadenadores, canales, datos, herramientas, flujos, instrucciones, arquitectura, gobernanza y evaluación

Cada sección facilita la discusión y la alineación, no la documentación rígida.

Categoría Descripción Ejemplo Errores comunes
Objetivo Pregúntese: "¿Qué resultado estoy tratando de lograr?"No: "¿Qué herramientas necesito?", "¿Qué conectores debo invocar?" o "¿Qué tema debo crear?"

Describa claramente por qué debe existir el agente, qué debe lograr y quién es el público objetivo. Céntrese en los resultados. Deje que el diseño del agente se base en el problema.

Aclarar:
  • El problema o brecha de valor
  • Usuarios objetivo
  • El impacto esperado
  • Cómo se define el éxito

Utilizar un formato de Jobs-To-Be-Done:
  • Como <usuario>
  • Necesito<Trabajo por hacer>
  • Así que<resultado>
  • Como nuevo empleado, Necesito comprender mis directivas de RR. HH. locales para poder navegar por la incorporación con confianza.
  • Como responsable de soporte informático, necesito procesar los correos de soporte automáticamente para que se reduzca el triaje manual.
  • Empezar por las características en lugar de por los resultados.
  • Diseñando para casos extremos.
  • Omitir criterios de éxito cuantificables.
Desencadenadores Un desencadenador de agente es el evento, condición o entrada específica que activa al agente para comenzar su trabajo o tarea. Una acción humana o un evento automatizado pueden iniciar el desencadenador.

Más información: Encontrar el desencadenador adecuado para el evento.
  • Un mensaje de usuario en el chat.
  • Un nuevo correo electrónico en una bandeja de entrada compartida.
  • Un nuevo registro en un sistema.
  • Un trabajo programado o recurrente.
  • Los agentes autónomos requieren desencadenadores explícitos. Sin ellos, el agente no se ejecuta.
  • El desencadenador depende del comportamiento impredecible del usuario, p. ej., cuando el usuario escribe una palabra clave o frase específica.
  • El desencadenador carece del contexto requerido; por ejemplo, el agente inicia pero no tiene suficientes metadatos (ID de registro, identidad del usuario) para actuar eficazmente.
  • Los desencadenadores se activan con mayor frecuencia de la que realmente requiere el escenario, lo que genera ejecuciones innecesarias y consumo de recursos.
  • El diseño del desencadenador no tiene en cuenta cuotas o límites de plataforma, lo que hace que los agentes alcancen los umbrales de uso o fallen bajo carga.
Herramientas e integraciones Defina qué acciones debe ser capaz de realizar el agente, no solo lo que conoce.

Las herramientas permiten que el agente recupere o actualice datos, llame a API, active flujos de trabajo, envíe mensajes y complete operaciones transaccionales. Enumere los sistemas de los que depende el agente y sus limitaciones (API, modelos de autenticación, límites de tasa y fronteras de responsabilidad/SLA).

Considere los resultados esperados, los criterios de éxito y calidad, y el comportamiento ante fallos y errores. Las dependencias suelen impulsar la viabilidad: abórdelas pronto.

Para más información: Mecanismos para agregar herramientas a los agentes.
  • Conector de ServiceNow → obtener detalles de vales
  • Conector de Microsoft Entra ID → obtener la ubicación del usuario
  • API de Jira → actualizar elementos de trabajo
  • Conector Outlook → responder al correo electrónico
  • No registrar acciones ni almacenar salidas para auditoría.
  • Suponiendo que las API sean estables y siempre estén disponibles.
  • Herramientas que conceden permisos excesivos.
  • Sin definir el comportamiento de respaldo de las llamadas a la herramienta (sin validación de la salida de la herramienta, sin retroceso cuando fallan las herramientas, sin ruta de escalada).
  • Ignorar los límites de tasa o la limitación.
  • Falta de asignación de dependencias (quién es responsable de cada API, cuál es el acuerdo de nivel de servicio).
  • No validar las precondiciones antes de realizar acciones.
Canales Un canal es la plataforma o interfaz específica donde el agente está implementado e interactúa con los usuarios.

El canal también afecta las expectativas de los usuarios sobre la latencia, la gestión de turnos y la experiencia.
  • Microsoft Teams
  • SharePoint
  • Microsoft 365 Copilot
  • Chat web o interfaces de voz
  • Seleccionar canales en función de la conveniencia o facilidad de implementación, en vez de considerar cómo y dónde trabajan realmente los usuarios.
  • Suponiendo que los usuarios se adapten al canal del agente, en lugar de encontrarse con ellos donde ya están.
  • Priorizar la viabilidad técnica sobre la experiencia del usuario, lo que resulta en una baja adopción incluso cuando el agente funciona correctamente.
  • Diseñar "chat-primero" cuando el canal real es impulsado por correo electrónico o flujo de trabajo (crear una experiencia de usuario conversacional, cuando el soporte se produce realmente a través de Outlook; olvidar que el correo electrónico funciona por turnos, no es conversacional)
  • Ignorar restricciones específicas de cada canal (Outlook requiere respuestas completas, no preguntas de aclaración; Teams admite Tarjetas adaptables, el correo electrónico no)
Conocimiento y datos Documente la información sobre la que el agente debe razonar y la ubicación donde el conocimiento o los datos están disponibles actualmente. Tenga en cuenta la calidad y la actualidad de los datos, el contenido estructurado frente al no estructurado, así como los límites de acceso y permisos.

La preparación de datos es una de los orígenes más comunes de obstáculos en etapas avanzadas si no se aborda a tiempo.
  • Documentos
  • Bases de datos
  • Sitios web
  • Knowledge Base
  • Sistemas internos o externos
  • Gobernanza de datos deficiente o inconsistente. Cuando la titularidad, la cadencia de actualización y los procesos de actualización no están definidos, los datos se vuelven rápidamente obsoletos o contradictorios.
  • Confundir "documentos" con "conocimiento". Señalar los grandes repositorios de documentos como fuente de verdad sin tener en cuenta si dichos documentos están actualizados, bien estructurados o etiquetados de forma coherente.
  • Las fuentes de conocimientos se contradicen entre sí. Múltiples versiones de una directiva, procedimiento o conjunto de datos llevan al agente a instrucciones contradictorias.
  • Los permisos y controles de acceso no están diseñados explícitamente. El contenido sensible queda expuesto de forma involuntaria, o bien el agente hace referencia a información a la que los usuarios finales no tienen acceso.
  • Expandir las fuentes de conocimientos sin validar los límites de seguridad, lo que resulta en agentes que comparten en exceso o fallan cuando el acceso está restringido.
Flujos y orquestación Defina cómo se estructura y secuencia el trabajo dentro del agente: cuándo usar flujos o temas deterministas, cuándo confiar en la orquestación y cuándo se requiere la intervención humana. El objetivo es un comportamiento predecible, automatización segura y una escalación clara.

Cuándo usar flujos o temas:
  • Recopilación de datos en varios pasos
  • Resolución de problemas guiada o árboles de decisión
  • Procesos impulsados por cumplimiento o directivas
  • Acciones de alto impacto o irreversibles
Los temas son el mecanismo principal de la lógica determinista.

Define:
  • Lo que el agente puede hacer de forma autónoma
  • Qué requiere aprobación, revisión o anulación humana
  • Cuándo el agente debe escalar o aplazar
  • Cómo la retroalimentación humana se traduce en la mejora
  • Agente tipo Pregúntame lo que sea: Flujos deterministas mínimos; depende sobre todo de la orquestación y el razonamiento generativo.
  • Agente autónomo: Utiliza flujos o temas para garantizar la secuenciación, las validaciones y las salvaguardas en pasos críticos.
  • Flujos de trabajo de aprobación: el agente prepara el contexto y las recomendaciones; los humanos aprueban o modifican las acciones de alto impacto.
  • La sobreestructuración fluye, limita la flexibilidad y hace que el agente se sienta rígido o frágil.
  • Estructurar insuficientemente los flujos, reducir la fiabilidad y hacer que los resultados sean impredecibles.
  • No usar explícitamente temas para lógica determinista, lo que lleva a comportamientos ad hoc o inconsistentes.
  • Desdibujar las responsabilidades entre persona y agente, resultando en rutas de escalada poco claras.
  • Sobrecargando a los humanos con aprobaciones para acciones de bajo riesgo, creando cuellos de botella y desincentivando el uso de agentes.
  • Agentes que actúan sin límites claros de "no actúes", especialmente en escenarios de riesgo o de alto riesgo.
Instrucciones y comportamiento Las instrucciones definen:
  • El rol y las responsabilidades del agente
  • Cómo razona y responde
  • Cuándo y cómo debe utilizar conocimientos, herramientas u otros agentes
  • La secuencia de acciones que debe seguir
  • Tono, límites y normas de seguridad
Instrucciones claras conectan conocimientos, herramientas y flujos en un sistema coherente y predecible.

Más información: Configurar instrucciones de alta calidad para orquestación generativa y Escribir instrucciones efectivas para agentes declarativos.
  • Rol y alcance: "Eres el Agente de Soporte de Correo Electrónico de TI responsable de leer los mensajes que llegan al buzón, extraer los números de vale y responder con información validada de ServiceNow."
  • Comportamiento secuenciado: "Paso 1: Revisa la base de conocimientos en busca de una directiva existente o un problema conocido. Paso 2: Si la información no se encuentra o está incompleta, llama a la herramienta ServiceNow para recuperar los detalles del vale. Paso 3: Si aún faltan datos necesarios, responde usando un patrón de "no lo sé" y realiza una escalada.
  • Reglas de uso de herramientas: "Valida siempre los identificadores extraídos con una llamada a la herramienta antes de usarlos en las respuestas."
  • Manejo de fallos: "Si falta conocimiento o falla una llamada a una herramienta, no adivine. Responde con una limitación clara y el siguiente paso."
  • Las instrucciones son demasiado vagas. Por ejemplo, "Ayudar a los usuarios con problemas de soporte" no especifica el dominio, los límites ni las acciones permitidas.
  • No hay claridad sobre cuándo usar conocimiento, herramientas u otros agentes, lo que lleva a comportamientos inconsistentes o ineficientes.
  • Las instrucciones no definen la secuencia de acciones, lo que hace que el agente mezcle conocimientos y salidas de herramientas de formas impredecibles.
  • Las reglas para el uso de herramientas no están definidas explícitamente, lo que puede llevar a que las herramientas se utilicen innecesariamente, no se utilicen en absoluto, o que los resultados del conocimiento y de las herramientas se mezclen de formas inesperadas.
  • Instrucciones contradictorias, como "siempre haz preguntas aclaratorias" y "responde solo con respuestas finales".
  • Sin una guía explícita de "no se debe hacer", como modificar datos confidenciales, compartir identificadores internos o dar asesoramiento legal o de recursos humanos sin fuentes verificadas.
Arquitectura y composición del agente Utilice varios agentes cuando:
  • Los dominios son grandes o distintos
  • La propiedad varía entre equipos
  • El acceso o los permisos varían
  • Se requiere razonamiento especializado
La delegación mejora la modularidad, claridad y mantenibilidad a largo plazo.

Más información: Explorar patrones de orquestación multiagente.
  • Un agente principal delega la consulta de vales a un agente de TI.
  • Un agente de conocimiento se encarga del control de calidad de documentos.
  • Un agente de enrutamiento decide a qué agente experto llamar.
  • La sobredelegación (demasiados agentes), por ejemplo, crear un agente separado para cada tarea menor, puede llevar a una proliferación arquitectónica y dificultar el mantenimiento, la depuración, la seguridad y la actualización de los agentes.
  • La subdelegación (un agente gigante), por ejemplo, un solo agente que se espera que responda a preguntas de RR. HH., consulte vales de TI, gestione la resolución de problemas y genere órdenes de compra e incidentes, puede dar lugar a un agente monolítico y frágil que es imposible de mantener.
  • Límites de delegación indefinidos. Por ejemplo, el agente principal no sabe cuándo ceder el control, los agentes secundarios no saben qué entradas deben esperar, o las responsabilidades se solapan (dos agentes verifican tickets de TI).
Gobernanza y administración de riesgos Defina cómo se gobierna, asegura y supervisa el agente para garantizar que se comporta de manera responsable, segura y predecible a lo largo de su ciclo de vida.

Esta definición incluye control de acceso, permisos de acción, límites de protección, responsabilidad y supervisión continua para gestionar tanto los riesgos operativos como los relacionados con la IA desde el primer día.

Más información: Capturar requisitos de gobernanza y Aplicar principios de IA responsable.
  • Modelo de autenticación y acceso: El agente utiliza la identidad en el nivel de usuario para recuperar solo los datos que el usuario tiene permitido ver, mientras que las identidades en el nivel de sistema están restringidas a operaciones de servicio claramente definidas.
  • Permisos de acción y salvaguardas de seguridad: El agente puede actualizar notas de trabajo o redactar respuestas, pero no puede realizar acciones irreversibles (como cerrar vales o enviar comunicaciones externas) sin aprobación.
  • Protecciones de seguridad y de contenido: La información sensible o regulada es detectada y bloqueada para evitar que sea compartida o se actúe sobre ella mediante protecciones de la plataforma (por ejemplo, prevención de pérdida de datos o filtros de seguridad).
  • Registro, auditoría y trazabilidad: Todas las acciones del agente, llamadas a herramientas, rechazos y escalaciones se registran y son auditables para fines de cumplimiento y revisión.
  • Propiedad operativa: El agente tiene un propietario, un patrocinador y un administrador operativo definidos, con permisos y comportamiento revisados de forma regular.
  • Diseñar los controles de gobernanza y gestión de riesgos demasiado tarde puede llevar a bloqueos en las implementaciones o retrasos en la producción.
  • Conceder permisos excesivos a los agentes "por conveniencia", aumentando el riesgo de exposición de datos o acciones no intencionadas.
  • Agentes configurados con permisos insuficientes, lo que provoca fallos en tiempo de ejecución cuando los sistemas o datos requeridos no son accesibles.
  • No integrar preocupaciones de IA responsable en las decisiones centrales de gobernanza.
  • Gobernanza operativa débil, como la falta de un propietario claro, de un plan de supervisión o de un proceso definido para la respuesta a incidentes.
  • No supervisar el comportamiento del agente después de la implementación, asumiendo que los controles de protección son suficientes.
Evaluación y optimización Diseñe pruebas que reproduzcan situaciones reales para medir la precisión, relevancia y calidad de las respuestas de los agentes. Proporcione una respuesta esperada y muestre cómo la respuesta del agente se compara con su respuesta o con la respuesta estándar.

Planifique cómo medir y mejorar el rendimiento:
  • Precisión y relevancia
  • Tiempo ahorrado o eficiencia
  • Adopción y uso
  • Señales de satisfacción y confianza
  • Calidad de las citas
  • Cumplimiento de permisos
  • Detección de información incorrecta
  • Aclaración del comportamiento de las preguntas

Defina qué telemetría recopilar:
  • Llamadas de herramientas
  • Acciones de agente
  • Errores y reintentos
  • Comentarios del usuario

Trate la evaluación como parte del diseño, no como una idea posterior. Más información: Diseñar y operacionalizar la evaluación de agentes.
  • Valide que la búsqueda de vales devuelva el estado correcto y no uno desactualizado.
  • Valide que los enlaces de referencia apunten a contenido vigente y aprobado.
  • Valida que el agente se niegue a proporcionar detalles sobre el ticket de otra persona.
  • Comprueba si el agente inventa un número de ticket o un artículo de KB.
  • Mide la cantidad de correos electrónicos procesados por el agente autónomo diariamente y el porcentaje de usuarios que eligen al agente sobre canales manuales.
  • Ejecutar evaluaciones demasiado tarde (después de la implementación).
  • Sin línea base ni punto de referencia.
  • Evaluaciones no vinculadas a escenarios reales.
  • Sin detección de regresión.
  • No hay evaluación de conversaciones de varios turnos.
  • No hay evaluador para la calidad del uso de herramientas.
  • Solo comprobando "escenarios felices".
  • Lagunas en telemetría.

Puntos clave de aprendizaje

Un marco de diseño estructurado actúa como un apoyo conceptual que ayuda a los equipos a razonar sobre los problemas y tomar decisiones más acertadas.

  • Empiece con resultados en lugar de características.
  • Evite los riesgos de gobernanza y de datos.
  • Cree agentes más seguros y confiables.
  • Diseñe para la escala, la confianza y la sostenibilidad a largo plazo.

Omitir el diseño puede acelerar el aprendizaje inicial, pero un diseño estructurado convierte los experimentos en soluciones duraderas y confiables.

Paso siguiente

Revise un ejemplo de cómo aplicar el marco de diseño estructurado.