Ir al contenido

Módulo 07 · Lección 27

Operar con salvaguardias en capas

Combine permisos, entradas, herramientas, aprobación, registros y salvaguardas humanas en lugar de depender de un solo mensaje.

Actualizado en agosto de 2026 · AI Agency Academy

lo que aprenderás

Tome una decisión operativa clara y más segura.

Podrá diseñar múltiples salvaguardas independientes en torno a un flujo de trabajo para que el resultado de un modelo confuso no pueda convertirse en una acción comercial incontrolada.

Por qué esto importa

El buen trabajo de un agente es útil antes de impresionar.

Una sola instrucción como “esté seguro” no es una salvaguardia. La operación segura proviene de limitar quién puede iniciar el flujo de trabajo, qué información ve, qué herramientas puede usar, qué debe aprobarse y cómo una persona puede revisarlo.

Nota de campo 27

Haz visible la relación.

Conceptos centrales

El lenguaje que mantiene el trabajo claro.

Defensa en profundidadVarios controles trabajan juntos para que un fallo no decida todo el resultado.
Guardado en este dispositivo.
Límite de entradaQué datos o tipos de solicitudes acepta el flujo de trabajo y cómo se maneja el contenido que no es de confianza.
Límite de herramientaLas acciones limitadas disponibles para el agente, con permisos separados para cada una.
Humano en el circuitoUna persona cuya revisión es significativa porque tiene evidencia, autoridad y tiempo para actuar.
El método práctico

Analice la decisión en orden.

  1. 01

    Proteger la entrada

    Valide el usuario, evento o permiso cuando sea práctico antes de proporcionar un contexto sensible o iniciar una acción.

  2. 02

    Limitar el contenido que no es de confianza

    Trate las instrucciones externas, los archivos adjuntos y los textos del cliente como datos para interpretar, no como una nueva autoridad a seguir.

  3. 03

    Restringir acciones

    Dé a cada herramienta un alcance limitado y exija aprobaciones para los cambios consiguientes.

  4. 04

    Mantenga registros revisables

    Almacene el desencadenante, el contexto relevante, las llamadas a herramientas, los resultados, la aprobación y la transferencia para que se puedan comprender los problemas.

Ejemplo resuelto

Una implementación realista y limitada.

Un agente de administración de cuentas puede resumir la solicitud de un cliente y redactar una orden de cambio. No puede aplicar el cambio ni alterar la facturación.

El texto del cliente puede influir en el resumen, pero no puede indicarle al agente que revele otras cuentas, cambie sus reglas o llame a una herramienta no relacionada. El agente recibe solo el contexto del espacio de trabajo del cliente y envía el borrador al propietario de la cuenta para su aprobación.

El propietario de la cuenta ve la solicitud, los detalles obtenidos, el borrador y el registro de auditoría antes de comunicarse con el cliente. Existen salvaguardas en los niveles de acceso, entrada, herramientas y aprobación.

Constrúyelo en la práctica

Utilice esta plantilla de trabajo copiable.

Adáptelo a la evidencia, las políticas, las personas y las herramientas del cliente. No trate los marcadores de posición como instrucciones aprobadas.

Control de entrada: [validación]. Entradas que no son de confianza: [tipos]. Herramientas permitidas: [lista de alcance]. Acciones de aprobación: [lista]. Registros requeridos: [campos]. Propietario de la escalación: [rol].
Implementación del cerebro espacial

Coloque el sistema operativo alrededor del agente.

Utilice roles de espacio de trabajo, permisos de contacto, automatizaciones condicionales, tareas de aprobación, integraciones con alcance e historial de actividad de CRM para crear capas operativas en torno a los flujos de trabajo de los agentes.

Practica

Antes de seguir adelante

  • Elija una acción de agente y enumere todas las salvaguardas que la rodean.
  • Agregue un control que aún proteja al cliente si falla la capa de instrucciones.
  • Pregunte si el revisor tiene suficiente autoridad para detener una mala acción.
  • La seguridad no depende de un solo aviso.
  • El contenido que no es de confianza no puede otorgar nueva autoridad.
  • Las herramientas están adaptadas al trabajo.
  • Los registros y la revisión humana se pueden utilizar en la práctica.

Pon el aprendizaje a trabajar

Cree un servicio de IA en el que la gente pueda confiar.

Cree una cuenta gratuita de Spacebrain y utilice la capa operativa en torno a su servicio de IA.

Empieza gratis