Skip to main content

Черновик раздумий агента (Scratchpad)

Временная область рабочей памяти в контекстном окне модели, где агент записывает свои промежуточные размышления, планы, сомнения и выводы перед вызовом инструментов. Скрыта от глаз конечного пользователя для сохранения чистоты финального интерфейса.

1. Обзор концепции и системная проблема

Когда вы решаете сложное математическое уравнение или планируете сложный маршрут путешествия, вы редко пишете сразу чистовик:

  • Вы берете черновик (лист бумаги).
  • Делаете промежуточные расчеты, зачеркиваете ошибочные варианты, рисуете стрелочки.
  • И только когда ответ сошелся — переносите финальный результат в бланк.

Искусственный интеллект нуждается в таком же листе бумаги.

Черновик агента (Agent Scratchpad) — это внутреннее поле для монолога модели:

  • Здесь агент держит в голове: «Что я уже сделал? Какой мой следующий шаг? Почему прошлый запрос вернул пустой массив?».
  • Как только черновик заполняется правильным выводом, агент выполняет действие или формулирует финальный ответ человеку.

Практическая аналогия: приватная зона мышления, где ИИ разрешено сомневаться, ошибаться и анализировать свои шаги.

2. Архитектурная таксономия и ментальная модель

┌─────────────────────────────────────────────────────────────┐
│                 КОНТЕКСТНОЕ ОКНО АГЕНТА                     │
├─────────────────────────────────────────────────────────────┤
│ 👤 ЗАПРОС ЧЕЛОВЕКА: «Обнови статус клиента #12 на VIP»      │
├─────────────────────────────────────────────────────────────┤
│ 🧠 СКРЫТЫЙ ЧЕРНОВИК (<scratchpad>):                        │
│    «Да, мне нужно найти клиента 12. Сначала проверю,       │
│    есть ли такой ID в системе через функцию get_client.      │
│    Вызываю get_client(12)...                                │
│    Вижу результат: сумма покупок клиента 150 000 грн.       │
│    По регламенту это соответствует статусу VIP.             │
│    Теперь могу безопасно вызвать set_status('VIP').»        │
├─────────────────────────────────────────────────────────────┤
│ 💬 ЧИСТОВИК ДЛЯ ПОЛЬЗОВАТЕЛЯ:                               │
│    «Статус клиента #12 успешно обновлен на VIP!»            │
└─────────────────────────────────────────────────────────────┘

3. Технический пайплайн и внутренняя механика

  1. Защита от импульсивных действий: без черновика модель пытается вызвать функцию с первого же слова и часто подставляет вымышленные или неполные параметры.
  2. Контроль истории действий: в черновике агент фиксирует перечень уже проверенных сайтов, чтобы не ходить по кругу одними и теми же ссылками.
  3. Удобство дебага для разработчика: если агент повел себя странно, инженер открывает логи черновика и дословно видит, какой именно ход мыслей привел модель к ошибочному выводу.

4. Практические инженерные сценарии в продакшене

01. Интеграция черновика в систему

Добавьте в системный промпт требование вести черновик: «Перед вызовом любого инструмента обязательно напиши свои размышления и план в блоке <thought>...</thought>. Это значительно снижает количество ошибок.

02. Анализ логов черновика

Используйте логи черновика для анализа поведения агента. Это поможет выявить паттерны ошибок и улучшить алгоритмы.

03. Обучение на основе черновика

Разработайте методику обучения, основанную на анализе черновиков, чтобы улучшить способность модели к размышлениям и принятию решений.

5. Подводные камни, типовые ошибки и безопасность

При использовании черновика важно учитывать:

  • Потенциальные утечки данных: убедитесь, что информация в черновике не содержит конфиденциальных данных, которые могут быть скомпрометированы.
  • Неправильные выводы: агент может сделать ошибочные выводы, если черновик не будет правильно структурирован.
  • Сложность отладки: слишком сложные размышления могут затруднить понимание логики агента, что усложнит процесс отладки.
/ Частые вопросыSchema.org FAQPage

FAQ: Черновик раздумий агента (Scratchpad)

Поскольку трансформеры генерируют ответ токен за токеном, модель не умеет думать «о себе» без вывода слов. Черновик дает модели возможность сгенерировать несколько предложений анализа ситуации, прежде чем вызвать опасную или необратимую команду (например, списание средств или удаление файла).
/ Внутренняя перелинковка
Все термины
Агенты и MCP

Цикл Действий Агента (Thought ➔ Action ➔ Observation / ReAct)

Фундаментальный алгоритмический паттерн работы автономных агентов (известный как ReAct: Reasoning + Acting). Состоит из бесконечного цикла трех шагов: 1) Мысль (Thought) — анализ ситуации; 2) Действие (Action) — вызов инструмента; 3) Наблюдение (Observation) — анализ результата и корректировка плана.

Читать термин
Промпты и RAG

Магия фразы «Думай крок за кроком» (Step-by-Step)

Легендарная техника промпт-инжиниринга (Zero-Shot Chain-of-Thought). Добавление волшебной фразы «Думай крок за кроком» заставляет нейросеть развернуть цепочку промежуточных вычислений, снижая количество логических ошибок на 50–70%.

Читать термин
Модели и Инференс

Бюджет на размышления (Thinking Budget в новых моделях)

Новый параметр современных моделей гибридного рассуждения (Claude 3.7 Sonnet, OpenAI o1/o3). Позволяет пользователю самостоятельно определять лимит токенов или секунд, которые искусственный интеллект имеет право потратить на внутренние размышления перед финальным ответом.

Читать термин