Bloc de Notas del Agente
Área temporal de memoria de trabajo en la ventana de contexto del modelo, donde el agente registra sus reflexiones intermedias, planes, dudas y conclusiones antes de invocar herramientas. Oculta a los ojos del usuario final para mantener la limpieza de la interfaz final.
1. Visión general del concepto y problema sistémico
Al resolver una ecuación matemática compleja o planear una ruta de viaje complicada, rara vez se escribe directamente la versión final:
- Se toma un bloc de notas (hoja de papel).
- Se realizan cálculos intermedios, se tachan opciones incorrectas, se dibujan flechas.
- Y solo cuando la respuesta coincide, se transfiere el resultado final al formulario.
La inteligencia artificial necesita un mismo tipo de hoja de papel.
Bloc de Notas del Agente (Agent Scratchpad) — es un campo interno para el monólogo del modelo:
- Aquí el agente mantiene en mente: “¿Qué he hecho ya? ¿Cuál es mi siguiente paso? ¿Por qué la consulta anterior devolvió un array vacío?”.
- Tan pronto como el bloc de notas se llena con la conclusión correcta, el agente ejecuta una acción o formula la respuesta final al humano.
Analogía práctica: zona privada de pensamiento, donde se permite a la IA dudar, cometer errores y analizar sus pasos.
2. Taxonomía arquitectónica y modelo mental
┌─────────────────────────────────────────────────────────────┐
│ VENTANA DE CONTEXTO DEL AGENTE │
├─────────────────────────────────────────────────────────────┤
│ 👤 CONSULTA DEL HUMANO: «Actualiza el estado del cliente #12 a VIP» │
├─────────────────────────────────────────────────────────────┤
│ 🧠 BLOC DE NOTAS OCULTO (<scratchpad>): │
│ «Sí, necesito encontrar al cliente 12. Primero verificaré,│
│ si existe tal ID en el sistema a través de la función get_client. │
│ Llamo a get_client(12)... │
│ Veo el resultado: la suma de compras del cliente es 150,000 UAH. │
│ Según el reglamento, esto corresponde al estado VIP. │
│ Ahora puedo invocar de manera segura set_status('VIP').» │
├─────────────────────────────────────────────────────────────┤
│ 💬 LIMPIEZA PARA EL USUARIO: │
│ «¡El estado del cliente #12 se ha actualizado exitosamente a VIP!» │
└─────────────────────────────────────────────────────────────┘
3. Pipeline técnico y mecánica interna
- Protección contra acciones impulsivas: sin el bloc de notas, el modelo intenta invocar funciones desde la primera palabra y a menudo introduce parámetros ficticios o incompletos.
- Control del historial de acciones: en el bloc de notas, el agente registra la lista de sitios ya verificados para no volver a visitar los mismos enlaces.
- Facilidad de depuración para el desarrollador: si el agente se comporta de manera extraña, el ingeniero abre los registros del bloc de notas y ve literalmente qué línea de pensamiento llevó al modelo a una conclusión errónea.
4. Escenarios prácticos de ingeniería en producción
01. Actualización de Estado de Cliente
02. Análisis de Respuestas de Usuario
03. Validación de Datos de Entrada
5. Errores comunes, trampas y seguridad
Si estás creando tu propio agente, siempre añade en el prompt del sistema la exigencia de llevar un bloc de notas: “Antes de invocar cualquier herramienta, asegúrate de escribir tus reflexiones y plan en el bloque <thought>...</thought>”. Esto reduce la cantidad de errores en un 40-50%.
FAQ: Bloc de Notas del Agente
Términos relacionados
Ciclo de Acción del Agente (Thought ➔ Action ➔ Observation / ReAct)
Patrón algorítmico fundamental para el funcionamiento de agentes autónomos (conocido como ReAct: Reasoning + Acting). Consiste en un ciclo infinito de tres pasos: 1) Pensamiento (Thought) — análisis de la situación; 2) Acción (Action) — llamada a la herramienta; 3) Observación (Observation) — análisis del resultado y ajuste del plan.
La Magia de la Frase 'Piensa Paso a Paso' (Step-by-Step)
Técnica legendaria de ingeniería de prompts (Zero-Shot Chain-of-Thought). Añadir la frase mágica 'Piensa paso a paso' obliga a la red neuronal a desglosar una cadena de cálculos intermedios, reduciendo los errores lógicos en un 50-70%.
Presupuesto de Reflexión (Thinking Budget en Nuevos Modelos)
Un nuevo parámetro en modelos modernos de razonamiento híbrido (Claude 3.7 Sonnet, OpenAI o1/o3). Permite al usuario definir el límite de tokens o segundos que la inteligencia artificial puede gastar en reflexión interna antes de la respuesta final.