Зациклення агентів та захист бюджету (Infinite Loops)(Зациклення агентів: чому ШІ може спустити $100 за ніч у нескінченному колі та як це зупинити)
Аварійний стан автономного агента, за якого він потрапляє у нескінченну рекурсивну петлю дій через повторювану помилку або неможливість досягти мети. Розглядаються механізми захисту гаманця: жорсткі ліміти кроків (Max Steps), ліміти витрат (Spend Caps) та детекція циклічності.
1. Огляд концепції та призначення
Один із найбільших нічних кошмарів розробників штучного інтелекту звучить так: ви запустили експериментального автономного агента ввечері, лягли спати, а вранці прокинулися і побачили рахунок від OpenAI на $350.
Що сталося? Агент потрапив у Нескінченну петлю (Infinite Loop):
- На кроці №3 виникла помилка: наприклад, сервер повернув
Connection Refused. - Агент подумав: «Нічого страшного, спробую ще раз».
- Надіслав ще один важкий запит на 50 000 токенів... і знову отримав помилку.
- Оскільки у нього не було команди зупинитися, він крутився в цьому колесі 8 годин без зупинки, як заведений робот-пилосос, що застряг між двома ніжками стільця.
Головний принцип для розробника: найважливіший урок фінансової грамотності: автономному ШІ ніколи не можна давати безлімітний кредит довіри без аварійного вимикача.
2. Анатомія зациклення агента
┌─────────────────────────────────────────────────────────────┐
│ АВАРІЙНА ПЕТЛЯ ЗАЦИКЛЕННЯ │
├─────────────────────────────────────────────────────────────┤
│ 1. Дія: Спроба відкрити сайт `example.com/api` │
│ └── Помилка: 403 Forbidden │
├─────────────────────────────────────────────────────────────┤
│ 2. Думка: «Ой, помилка 403. Спробую оновити сторінку» │
│ └── Списано: 3 000 токенів ($0.05) │
├─────────────────────────────────────────────────────────────┤
│ 3. Дія: Оновлення сторінки `example.com/api` │
│ └── Помилка: 403 Forbidden │
├─────────────────────────────────────────────────────────────┤
│ 4. Думка: «Знову 403. Спробую ще раз через секунду...» │
│ └── Списано: 3 000 токенів ($0.05) │
├─────────────────────────────────────────────────────────────┤
│ ⚠️ ЦИКЛ ПОВТОРЮЄТЬСЯ 5 000 РАЗІВ ЗА НІЧ! ➔ Баланс = -$250 │
└─────────────────────────────────────────────────────────────┘
3. Чотири обов'язкові правила захисту гаманця
- Жорсткий ліміт кроків (
max_iterations = 10): жодне звичайне завдання не повинно виконуватися довше 10–15 ітерацій. - Детекція зациклення (Loop Detection): якщо агент викликає ту саму функцію з тими самими параметрами тричі поспіль — система примусово зупиняє його і кличе людину.
- Бюджетний ліміт на сесію (
max_cost = $0.50): автоматичне переривання діалогу, якщо вартість токенів одного запуску перевищує заданий поріг. - Встановлення Hard Limit в акаунті: у налаштуваннях білінгу провайдера завжди виставляйте максимум (наприклад, $15/місяць).
4. Практичний висновок
Автономні агенти — це неймовірна сила, але дисципліна лімітів та аварійних запобіжників — це перше, що повинен налаштувати будь-який інженер, перш ніж пускати агента у вільне плавання.
FAQ: Зациклення агентів та захист бюджету (Infinite Loops)
Пов'язані терміни
Цикл дій агента (Thought ➔ Action ➔ Observation / ReAct)
Фундаментальний алгоритмічний патерн роботи автономних агентів (відомий як ReAct: Reasoning + Acting). Складається з нескінченного циклу трьох кроків: 1) Думка (Thought) — аналіз ситуації; 2) Дія (Action) — виклик інструменту; 3) Спостереження (Observation) — аналіз результату та коригування плану.
Рейт-ліміти та помилка 429 (Too Many Requests)
Обмеження провайдерів на швидкість та кількість звернень до моделей (RPM — запити за хвилину, TPM — токени за хвилину). Пояснення причин виникнення помилки 429 та стратегії її обходу.
Кнопка підтвердження людиною (Human-in-the-Loop / HITL)
Архітектурний патерн безпеки автономних агентів (Human-in-the-Loop), що встановлює контрольні точки (Approval Gates) перед виконанням критичних дій. Агент готує операцію (платіж, видалення бази, відправка листа клієнту), але призупиняє роботу до явного схвалення живою людиною.