# Claude Fable 5: коли використовувати потужну модель і який рівень effort обрати

> Повний розбір моделі Claude Fable 5 та параметру effort: як працює поведінковий сигнал міркування, матриця доступності рівнів (low/xhigh), розрахунок вартості за хід та налаштування в API і Claude Code.

Claude Fable 5 — це флагманська модель Anthropic нового класу Mythos, створена для найскладніших багатокрокових задач на міркування та автономної агентної розробки. Разом із цією моделлю розробники отримали новий фундаментальний механізм управління поведінкою — параметр `effort`.

Цей гайд детально розбирає можливості Fable 5, принципи роботи параметра `effort`, тарифікацію токенів міркування та практичні стратегії вибору конфігурації для оптимізації швидкості й витрат у продакшні.

---

## 1. Fable 5 у двох словах: що це за модель і навіщо вона потрібна

Claude Fable 5 позиціонується як найпотужніша з широко доступних моделей Anthropic, що стоїть вище за рівень Opus. Вона розроблена для задач, де звичайні моделі заходять у глухий кут або втрачають контекст на довгих дистанціях.

### 1.1. Позиціонування моделі та сімейство Mythos

Fable 5 — це перша загальнодоступна реалізація архітектури класу Mythos. Над нею існує обмежена дослідницька версія — Mythos 5, яка позбавлена додаткових шарів зовнішніх фільтрів і надається виключно авторизованим дослідницьким групам через ініціативу Project Glasswing.

Модель підтримується в середовищі **Claude Code** та платформі **Managed Agents**, пропонуючи контекстне вікно в 1 000 000 токенів та генерацію до 128 000 токенів на один запит.

> [!NOTE]
> У веб-інтерфейсі Fable 5 доступна для користувачів тарифних планів Pro та Max, а в API викликається за ідентифікатором `claude-fable-5`.

### 1.2. Бенчмарки, мультимодальність та концепція No-Slop Code

На тестах Fable 5 демонструє результати рівня State-of-the-Art (SOTA) у складних дисциплінах:
- **Агентне програмування:** самостійне розгортання репозиторіїв, пошук багів і написання тестів.
- **Генерація No-Slop Code:** код без надлишкових обгорток, штучних коментарів і сміттєвих абстракцій.
- **Мультимодальне сприйняття:** проходження ігор (зокрема Pokemon FireRed) виключно за відеопотоком/скріншотами без текстових підказок.
- **Наукові дослідження:** моделювання в VibeCAD та аналіз біомедичних структур.

Ключова закономірність Fable 5: перевага над Sonnet та Opus стає відчутною саме на довгих, багатокрокових ітераціях.

---

## 2. Коли є сенс використовувати Fable 5, а коли — ні

Висока продуктивність моделі супроводжується підвищеною вартістю, тому її застосування має бути економічно та інженерно обґрунтованим.

### 2.1. Оптимальні та неефективні сценарії використання

Fable 5 створена для задач із високою ціною помилки:

| Рекомендовано використовувати | Не варто переплачувати |
| --- | --- |
| Комплексний рефакторинг монолітів та міграції систем | Прості CRUD-операції та шаблонні скрипти |
| Багатокрокові агентні сесії (від 20 до 100+ ходів) | Одноразова класифікація або екстракція даних |
| Пошук тонких race condition та проблем безпеки | Написання простих юніт-тестів для відомих функцій |
| Архітектурне проектування нових підсистем | Швидка суммаризація коротких нотаток |

### 2.2. Чотири правила підготовки до продакшну та параметри доступу

Перед інтеграцією Fable 5 у ваші пайплайни врахуйте такі інженерні аспекти:

1. **Спрощуйте системні промпти:** Fable 5 мислить концептуально. Жорсткі покрокові скрипти зі старих моделей лише обмежують її потенціал — задавайте кінцеву мету та межі допустимого.
2. **Керуйте параметром effort:** Налаштування зусиль — головний важіль контролю затримки (latency) та фінансових витрат.
3. **Закладайте таймаути на довгі ходи:** Складні міркування на фронтирних задачах можуть займати хвилини; обмежуйте максимальні ітерації агентів.
4. **Обробляйте відмови (Refusals):** Через суворі внутрішні правила безпеки частина граничних запитів повертає відмову, що вимагає наявності резервної обробки в коді.

---

## 3. Що взагалі робить effort і як він працює

З появою Fable 5 інженери Anthropic кардинально переглянули систему налаштувань. Звичні параметри семплінгу (температура, top-p) та ручний `budget_tokens` відійшли в минуле.

### 3.1. Механізм поведінкового сигналу vs фіксований бюджет токенів

Головним інструментом тонкого налаштування став параметр **`effort`**, який передається всередині конфігурації виводу: `output_config={"effort": "..."}`.

> [!IMPORTANT]
> Параметр `effort` — це якісний поведінковий сигнал, а не жорсткий ліміт токенів. Він повідомляє моделі, наскільки глибоко досліджувати простір гіпотез і скільки зусиль докладати до верифікації. Жорсткою межею генерації залишається тільки `max_tokens`.

### 3.2. Вплив на виклики інструментів, пояснення та генерацію

На відміну від застарілого `budget_tokens`, який керував лише фазою внутрішнього міркування, `effort` масштабує всі аспекти відповіді:
- **На рівні low:** модель генерує менше викликів інструментів, групує команди в один запит, мінімізує вступні формулювання і повертає лаконічний результат.
- **На рівні high / xhigh:** модель розгортає внутрішній план, перевіряє проміжні результати додатковими інструментами та надає вичерпні коментарі.

---

## 4. П'ять рівнів effort і де який доступний

Messages API підтримує фіксований список із п'яти допустимих значень параметра `effort`.

### 4.1. Офіційна шкала від low до xhigh

| Рівень | Поведінковий опис за документацією Anthropic | Доступність у сімействі моделей |
| :--- | :--- | :--- |
| **xhigh** | Максимальна глибина міркування для довгих агентних сесій (>30 хв) із мільйонними бюджетами | Тільки Fable 5, Mythos 5, Opus 4.8, Opus 4.7 |
| **high** | Значення за замовчуванням: розгорнуте міркування, планування та перевірка кроків | Усі моделі з підтримкою effort |
| **medium** | Збалансований рівень із помірною економією токенів без втрати логіки | Усі моделі з підтримкою effort |
| **low** | Максимальна швидкість та мінімальні витрати токенів при базовому контролі якості | Усі моделі з підтримкою effort |
| **max** | Екстремальне, безлімітне міркування для специфічних наукових задач | Спеціальні сесії Claude Code |

### 4.2. Підтримка за моделями та індивідуальне калібрування

Рівень **xhigh** є ексклюзивним: на Opus 4.6 та Sonnet 4.6 цей рівень відсутній. Більше того, шкала зусиль калібрується для кожної нейромережі окремо: `high` для Fable 5 генерує значно глибшу траєкторію міркувань, ніж `high` для Opus 4.6.

---

## 5. Дефолти за моделями та різними середовищами: API і Claude Code

Поведінка моделі без явного зазначення параметрів відрізняється залежно від середовища виконання.

### 5.1. Порівняння значень за замовчуванням в API та Claude Code

| Модель | Дефолт у Messages API | Дефолт у Claude Code |
| :--- | :--- | :--- |
| **Claude Fable 5** | `high` | `high` |
| **Claude Opus 4.8** | `high` | `high` |
| **Claude Opus 4.7** | `high` | `xhigh` |
| **Claude Opus 4.6 / Sonnet 4.6** | `high` | `high` |

### 5.2. Поведінка фолбеків та збереження стану між сесіями

- **Автоматичний відкат (Fallback):** Якщо ви викликали сесію з рівнем `xhigh`, а потім перемкнулися на Opus 4.6, Claude Code автоматично відкочується до `high` без аварійної зупинки.
- **Персистентність рівнів:** Рівні від `low` до `xhigh` зберігаються між запусками Claude Code. Рівень `max` навмисно скидається після завершення сесії, щоб запобігти неконтрольованому спалюванню бюджету користувача.

---

## 6. Як effort пов'язаний з міркуванням моделі

Робота з внутрішнім міркуванням (Thinking) кардинально відрізняється між генераціями моделей.

### 6.1. Особливості Fable 5 проти адаптивного режиму в Opus

- **Fable 5:** Міркування вбудоване в архітектуру і ввімкнене постійно. Спроба передати `thinking: {"type": "disabled"}` повертає помилку `HTTP 400 Bad Request`.
- **Opus 4.7 / 4.8:** Адаптивне міркування вимкнено за замовчуванням і активується викликом `thinking: {"type": "adaptive"}`.

### 6.2. Міграція з застарілого параметра budget_tokens

> [!WARNING]
> Якщо ви оновлюєте кодову базу з попередніх версій Claude SDK, параметр `budget_tokens` більше не підтримується. Його використання поверне помилку API. Замініть його на об'єкт `output_config={"effort": "..."}`.

---

## 7. У скільки обходиться кожен рівень: розрахунок вартості

Параметр `effort` не змінює базову ставку за мільйон токенів. Він впливає на фінальний рахунок опосередковано — через кількість згенерованих токенів міркування.

### 7.1. Тарифікація прихованих токенів міркування (Thinking Tokens)

На Fable 5 за замовчуванням вивід тексту міркування приховано (`omitted`), проте кожен токен внутрішніх роздумів тарифікується як повноцінний вихідний токен за стандартною ставкою: **$10 за 1 млн вхідних токенів** та **$50 за 1 млн вихідних токенів**.

### 7.2. Розрахунок вартості на хід та вплив нового токенізатора

Оцінка вартості одного ходу в агентному завданні при 20 000 вхідних токенах (на прикладі Opus 4.8):

| Сценарій і рівень | Токени виводу | Вхід ($5/M) | Вихід ($25/M) | Підсумок за 1 хід |
| :--- | :--- | :--- | :--- | :--- |
| **low** (лаконічно, стислі інструменти) | 5 000 | $0,10 | $0,125 | **~$0,23** |
| **high** (планування, валідація коду) | 20 000 | $0,10 | $0,50 | **~$0,60** |
| **xhigh** (глибоке дослідження архітектури) | 60 000 | $0,10 | $1,50 | **~$1,60** |

> [!TIP]
> Для Fable 5 помножте ці цифри на 2 (вихід $50/M). Різниця між `low` та `xhigh` на довгій агентній сесії у 50 ходів може становити від $25 до $160!

---

## 8. Який рівень обирати під тип задачі

Щоб не перевитрачати бюджет, використовуйте диференційований підхід до розподілу навантаження.

### 8.1. Стратегії вибору для Fable 5 та Opus

:::tabs
=== Fable 5 (Флагманські задачі)
Починайте роботу з дефолтного рівня **high**. Рівень `high` на Fable 5 перевершує за якістю `xhigh` попередніх поколінь моделей. Переходьте на `xhigh` лише тоді, коли агент вирішує завдання тривалістю понад 30 хвилин або проектує нову архітектуру з нуля.
=== Opus 4.8 / 4.7 (Кодинг)
Рекомендований старт для розробки — рівень **xhigh**. Він розкриває максимальний потенціал аналізу коду в Opus. Рівень `medium` підключайте після валідації тестів для оптимізації бюджету.
=== Фонова автоматизація (low)
Використовуйте рівень **low** для рутинних підзадач, генерації документації, швидкого парсингу та субагентів, де затримка критичніша за глибоку аналітику.
:::

### 8.2. Багаторівнева архітектура: оркестратор і субагенти

Найефективніший патерн у продакшні — ієрархія агентів:
- **Головний оркестратор:** Fable 5 на рівні `high` або `xhigh` (будує дерево завдань і валідує код).
- **Робочі субагенти:** Sonnet 4.6 або Fable 5 на рівні `low` (швидко виконують локальні ізольовані правки).

---

## 9. Як задати effort на практиці: Claude Code та API

Керувати параметром можна як через CLI-інтерфейс розробника, так і програмно через Messages API.

### 9.1. Налаштування в Claude Code CLI та режим ultracode

Утиліта Claude Code надає гнучкі можливості керування:
- Команда `/effort` викликає інтерактивне меню.
- Прапорець запуску: `claude --effort xhigh`.
- Змінна середовища: `export CLAUDE_CODE_EFFORT_LEVEL=xhigh`.

> [!NOTE]
> Режим **ultracode** у меню `/effort` — це внутрішній режим Claude Code, який поєднує рівень `xhigh` із розширеними правами оркестратора на виконання довгих автономних циклів дій.

### 9.2. Виклики через Messages API та взаємодія з fast mode

:::tabs
=== Python SDK
```python
import anthropic

client = anthropic.Anthropic()

response = client.messages.create(
    model="claude-fable-5",
    max_tokens=64000,
    output_config={"effort": "xhigh"},
    messages=[
        {"role": "user", "content": "Проведи аудит архітектури мікросервісів"}
    ]
)
print(response.content[0].text)
```
=== TypeScript SDK
```typescript
import Anthropic from "@anthropic-ai/sdk";

const anthropic = new Anthropic();

const response = await anthropic.messages.create({
  model: "claude-fable-5",
  max_tokens: 64000,
  output_config: { effort: "xhigh" },
  messages: [
    { role: "user", content: "Проведи аудит архітектури мікросервісів" }
  ],
});
console.log(response.content[0]);
```
=== cURL (Messages API)
```bash
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-fable-5",
    "max_tokens": 64000,
    "output_config": {"effort": "high"},
    "messages": [{"role": "user", "content": "Hello Fable!"}]
  }'
```
:::

---

## 10. Часті запитання (FAQ)

### 10.1. Доступність рівня xhigh та фолбеки між моделями

> **Питання:** Чи можу я використовувати `xhigh` на всіх моделях Claude?  
> **Відповідь:** Ні. Рівень `xhigh` доступний виключно для Fable 5, Mythos 5, Opus 4.8 та Opus 4.7. Якщо в Claude Code обрати `xhigh` для Opus 4.6 або Sonnet 4.6, система автоматично виконає запит на рівні `high`.

### 10.2. Ціноутворення за токен проти сумарної вартості

> **Питання:** Чи підвищує рівень `effort` вартість одного токена?  
> **Відповідь:** Ні, ціна за 1 000 000 токенів фіксована ($10 вхід / $50 вихід для Fable 5). Більша вартість запиту зумовлена виключно тим, що модель генерує більше прихованих токенів міркування та виконує більше викликів інструментів.

### 10.3. Відмінності ultracode від системної інструкції ultrathink

> **Питання:** У чому різниця між `ultracode` та `ultrathink`?  
> **Відповідь:** `ultracode` — це конфігурація середовища Claude Code (рівень `xhigh` + розширені права автономності). Своєю чергою, `ultrathink` — це текстовий промпт-тригер користувача всередині чату з проханням міркувати максимально глибоко на поточному ході.

### 10.4. Доцільність постійної роботи на максимальних налаштуваннях

> **Питання:** Чи варто завжди вмикати Fable 5 на рівень `xhigh`?  
> **Відповідь:** Ні. За даними розробників Anthropic, Fable 5 на рівні `high` вже перевершує попередні флагмани на максимумі. Постійна робота на `xhigh` призводить до відчутної затримки та швидкого вичерпання лімітів без істотного приросту якості на звичайних задачах.