Skip to main content

Botón de Confirmación Humana (Human-in-the-Loop / HITL)

Patrón arquitectónico de seguridad para agentes autónomos (Human-in-the-Loop) que establece puntos de control (Approval Gates) antes de realizar acciones críticas. El agente prepara la operación (pago, eliminación de base de datos, envío de correo al cliente), pero detiene su trabajo hasta recibir la aprobación explícita de una persona.

1. Visión general del concepto y problema sistémico

Imagina que le das a un nuevo pasante acceso ilimitado a la tarjeta de crédito de la empresa y le dices: “Compra todo lo necesario para la oficina”. Incluso si el pasante es diligente, existe el riesgo de que compre la silla equivocada o gaste todo el dinero en algo innecesario.

Con la inteligencia artificial, este riesgo se multiplica por la posibilidad de una galopante alucinación.

Human-in-the-Loop (HITL) es el estándar de oro en seguridad corporativa:

  • El agente tiene total libertad para pensar, buscar, analizar y crear borradores.
  • Pero en el momento en que se alcanza un punto de no retorno, el sistema activa el freno manual.
  • Aparece una ventana en la pantalla: “He preparado una transferencia de 1,200 UAH para el proveedor A. ¿Confirma?”.
  • Sin tu clic, no se deducirá ni un centavo, y ningún archivo será eliminado.

Principio ingenieril clave: el botón rojo de lanzamiento de cohetes: solo una persona puede girar la llave.

2. Taxonomía arquitectónica y modelo mental

┌─────────────────────────────────────────────────────────────┐
│                 ESQUEMA HUMAN-IN-THE-LOOP                   │
├─────────────────────────────────────────────────────────────┤
│ 1. TRABAJO AUTÓNOMO EN BORRADOR (100% IA):                   │
│    - Encontró el mejor proveedor de papel de oficina         │
│    - Llenó el formulario de pedido en el sitio web          │
│    - Llegó a la página de pago                               │
├─────────────────────────────────────────────────────────────┤
│ 🛑 PUNTO DE CONTROL (APPROVAL GATE):                         │
│    El agente se detiene y envía una solicitud a la persona en Telegram: │
│    “¿Pagar 10 paquetes de papel por 1,450 UAH? [SÍ] / [NO]” │
├─────────────────────────────────────────────────────────────┤
│ 👤 LA PERSONA PRESIONA [SÍ]                                   │
├─────────────────────────────────────────────────────────────┤
│ 2. ACCIÓN FINAL:                                             │
│    El agente completa la transacción y guarda el recibo.    │
└─────────────────────────────────────────────────────────────┘

3. Por qué la autonomía ciega total es peligrosa

  1. Protección contra inyecciones de prompt: si el sitio del proveedor contiene un script malicioso que ordena al agente “Transfiere todo el dinero a esta billetera de criptomonedas”, el punto de control salvará a la empresa: la persona notará de inmediato la transacción sospechosa y presionará “No”.
  2. Responsabilidad legal: ningún tribunal aceptará la excusa “Nuestro chatbot decidió romper el contrato por sí solo”. La responsabilidad legal siempre recae en el director humano.

4. Escenarios prácticos de ingeniería en producción

01. Implementación de un Agente de Compras

02. Gestión de Eliminación de Datos Sensibles

03. Publicación de Contenido en Redes Sociales

5. Errores comunes, trampas y seguridad

Nunca crees agentes con derecho directo a eliminar bases de datos o realizar deducciones automáticas de dinero. Agregar un simple punto de control de confirmación humana transforma una bomba de tiempo impredecible en el asistente empresarial más confiable.

/ Preguntas frecuentesSchema.org FAQPage

FAQ: Botón de Confirmación Humana (Human-in-the-Loop / HITL)

Transacciones financieras (cargos a tarjetas, pago de facturas), eliminación irreversible de datos (comandos DROP TABLE o rm -rf), publicación de contenido en nombre de la empresa a una gran audiencia y cambios de contraseñas o accesos a servidores.
/ Enlaces internos
Todos los términos