# Claude Fable 5: когда использовать мощную модель и какой уровень effort выбрать

> Полный разбор модели Claude Fable 5 и параметра effort: поведенческий сигнал рассуждений, матрица доступности уровней (low/xhigh), расчет затрат на ход и практическая настройка в API и Claude Code.

Claude Fable 5 — флагманская модель Anthropic нового класса Mythos, созданная для сложнейших многошаговых задач на рассуждения и автономной агентной разработки. Вместе с этой моделью разработчики получили новый фундаментальный инструмент управления поведением — параметр `effort`.

Этот гайд детально разбирает возможности Fable 5, принципы работы параметра `effort`, тарификацию токенов рассуждений и практические стратегии выбора конфигураций для баланса скорости, точности и бюджета в продакшне.

---

## 1. Fable 5 в двух словах: что это за модель и зачем она нужна

Claude Fable 5 позиционируется как самая мощная из широко доступных моделей Anthropic, находящаяся выше уровня Opus. Она разработана для сценариев, где стандартные модели заходят в тупик или теряют нить контекста на длинных дистанциях.

### 1.1. Позиционирование модели и семейство Mythos

Fable 5 — первая массовая реализация архитектуры класса Mythos. Над ней существует закрытая исследовательская версия — Mythos 5, лишенная внешних фильтров безопасности и предоставляемая исключительно авторизованным академическим группам через инициативу Project Glasswing.

Модель поддерживается в среде **Claude Code** и на платформе **Managed Agents**, предоставляя контекстное окно в 1 000 000 токенов и генерацию до 128 000 токенов на один запрос.

> [!NOTE]
> В веб-интерфейсе Fable 5 доступна для пользователей подписок Pro и Max, а в API вызывается по идентификатору `claude-fable-5`.

### 1.2. Бенчмарки, мультимодальность и концепция No-Slop Code

На сравнительных тестах Fable 5 демонстрирует результаты уровня State-of-the-Art (SOTA) в сложнейших дисциплинах:
- **Агентное программирование:** автономное развертывание проектов, локализация багов и генерация тестов.
- **Генерация No-Slop Code:** чистый идиоматичный код без избыточных оберток, искусственных комментариев и мусорных абстракций.
- **Мультимодальное восприятие:** прохождение игр (включая Pokemon FireRed) исключительно по видеоряду/скриншотам без текстовых подсказок.
- **Научное моделирование:** параметрическое проектирование в VibeCAD и биомедицинский анализ.

Главная закономерность Fable 5: качественный отрыв от Sonnet и Opus многократно возрастает на длительных многоходовых итерациях.

---

## 2. Когда есть смысл использовать Fable 5, а когда — нет

Высокая вычислительная мощность модели сопровождается повышенной стоимостью и задержкой, поэтому ее внедрение требует взвешенного инженерного подхода.

### 2.1. Оптимальные и неэффективные сценарии использования

Fable 5 раскрывает потенциал там, где цена ошибки или человеческого вмешательства высока:

| Рекомендуется использовать | Неоправданная переплата |
| --- | --- |
| Глубокий рефакторинг монолитных систем и миграции кодовых баз | Шаблонные CRUD-операции и простые скрипты |
| Длинные агентные прогоны (от 20 до 100+ последовательных ходов) | Однократная классификация текста или извлечение сущностей |
| Поиск скрытых race condition и уязвимостей безопасности | Написание тривиальных юнит-тестов для базовых функций |
| Архитектурное проектирование новых подсистем с нуля | Быстрая суммаризация коротких писем или заметок |

### 2.2. Четыре правила подготовки к продакшну и параметры доступа

Перед интеграцией Fable 5 в рабочие процессы учтите четыре ключевых фактора:

1. **Упрощайте системные промпты:** Fable 5 отлично оперирует абстрактными целями. Жесткие пошаговые инструкции от старых моделей сковывают рассуждения — задавайте конечный результат и границы дозволенного.
2. **Управляйте параметром effort:** Настройка усилий — главный рычаг контроля задержки (latency) и расходов на токены.
3. **Закладывайте тайм-ауты на длинные ходы:** Сложные рассуждения могут занимать минуты; строго ограничивайте число циклов агента.
4. **Обрабатывайте отказы (Refusals):** Из-за строгих фильтров безопасности пограничные запросы могут возвращать отказ, требующий резервных сценариев обработки в коде.

---

## 3. Что вообще делает effort и как он работает

С выходом Fable 5 команда Anthropic отказалась от привычных параметров семплирования (температура, top-p) и ручного управления через `budget_tokens`.

### 3.1. Механизм поведенческого сигнала vs жесткий бюджет токенов

Ключевым инструментом настройки стал параметр **`effort`**, передаваемый внутри конфигурации вывода: `output_config={"effort": "..."}`.

> [!IMPORTANT]
> Параметр `effort` — это качественный поведенческий сигнал, а не фиксированный лимит токенов. Он сообщает модели, насколько глубоко исследовать пространство гипотез. Единственным жестким потолком генерации остается `max_tokens`.

### 3.2. Влияние на вызовы инструментов, пояснения и генерацию

В отличие от устаревшего `budget_tokens`, который ограничивал только фазу внутренних рассуждений, `effort` масштабирует поведение модели целиком:
- **На уровне low:** модель делает меньше вызовов инструментов, объединяет команды в один запрос, опускает вводные формулировки и отвечает максимально кратко.
- **На уровне high / xhigh:** модель подробно расписывает план действий, перепроверяет результаты дополнительными инструментами и дает исчерпывающие комментарии к коду.

---

## 4. Пять уровней effort и где какой доступен

Messages API поддерживает фиксированный перечень из пяти допустимых строковых значений параметра `effort`.

### 4.1. Официальная шкала от low до xhigh

| Уровень | Поведенческое описание по документации Anthropic | Доступность в модельном ряду |
| :--- | :--- | :--- |
| **xhigh** | Максимальная глубина рассуждений для длительных сессий (>30 мин) с миллионными бюджетами | Только Fable 5, Mythos 5, Opus 4.8, Opus 4.7 |
| **high** | Значение по умолчанию: развернутые рассуждения, планирование и перепроверка шагов | Все модели с поддержкой effort |
| **medium** | Сбалансированный уровень с умеренной экономией токенов без потери логики | Все модели с поддержкой effort |
| **low** | Максимальная скорость и минимальный расход токенов при базовом контроле качества | Все модели с поддержкой effort |
| **max** | Экстремальные, неограниченные рассуждения для фронтирных исследовательских задач | Специальные сессии Claude Code |

### 4.2. Поддержка по моделям и индивидуальная калибровка

Уровень **xhigh** является эксклюзивным: на Opus 4.6 и Sonnet 4.6 он отсутствует. Кроме того, шкала усилий калибруется индивидуально для каждой модели: уровень `high` на Fable 5 генерирует намного более глубокую цепочку рассуждений, чем `high` на Opus 4.6.

---

## 5. Дефолты по моделям и разным средам: API и Claude Code

Поведение модели без явного указания параметров различается в зависимости от среды вызова.

### 5.1. Сравнение значений по умолчанию в API и Claude Code

| Модель | Дефолт в Messages API | Дефолт в Claude Code |
| :--- | :--- | :--- |
| **Claude Fable 5** | `high` | `high` |
| **Claude Opus 4.8** | `high` | `high` |
| **Claude Opus 4.7** | `high` | `xhigh` |
| **Claude Opus 4.6 / Sonnet 4.6** | `high` | `high` |

### 5.2. Поведение фолбеков и сохранение состояния между сессиями

- **Автоматический откат (Fallback):** Если вы указали `xhigh`, а затем переключились на модель Opus 4.6, Claude Code автоматически применит уровень `high` без генерации ошибки.
- **Сохранение настроек:** Значения от `low` до `xhigh` сохраняются между запусками Claude Code. Уровень `max` действует только в рамках текущей сессии, предотвращая случайный перерасход средств.

---

## 6. Как effort связан с рассуждениями модели

Механика работы внутреннего мышления (Thinking) кардинально различается между поколениями моделей.

### 6.1. Особенности Fable 5 против адаптивного режима в Opus

- **Fable 5:** Рассуждения вшиты в архитектуру и включены постоянно. Попытка передать `thinking: {"type": "disabled"}` возвращает ошибку `HTTP 400 Bad Request`.
- **Opus 4.7 / 4.8:** Адаптивное мышление отключено по умолчанию и активируется параметром `thinking: {"type": "adaptive"}`.

### 6.2. Миграция с устаревшего параметра budget_tokens

> [!WARNING]
> Если вы обновляете кодовую базу с более ранних версий Claude SDK, параметр `budget_tokens` больше не поддерживается и вызовет ошибку API. Замените его на объект `output_config={"effort": "..."}`.

---

## 7. Во сколько обходится каждый уровень: расчет стоимости

Параметр `effort` не меняет базовый тариф за 1 млн токенов. Он влияет на стоимость косвенно — через объем сгенерированных токенов рассуждений.

### 7.1. Тарификация скрытых токенов рассуждений (Thinking Tokens)

На Fable 5 текст рассуждений по умолчанию скрыт (`omitted`), однако каждый сгенерированный токен мыслительного процесса оплачивается как стандартный выходной токен: **$10 за 1 млн входных** и **$50 за 1 млн выходных токенов**.

### 7.2. Расчет стоимости на ход и влияние нового токенизатора

Оценка затрат на один ход в агентном сценарии при 20 000 входных токенов (на примере Opus 4.8 с тарифом $5/$25):

| Сценарий и уровень | Токены вывода | Вход ($5/M) | Выход ($25/M) | Итого за 1 ход |
| :--- | :--- | :--- | :--- | :--- |
| **low** (кратко, минимум инструментов) | 5 000 | $0,10 | $0,125 | **~$0,23** |
| **high** (планирование, валидация) | 20 000 | $0,10 | $0,50 | **~$0,60** |
| **xhigh** (глубокий архитектурный анализ) | 60 000 | $0,10 | $1,50 | **~$1,60** |

> [!TIP]
> Для Fable 5 умножьте эти значения на 2 (выход $50/M). Разница между `low` и `xhigh` на длинной сессии из 50 ходов может составить от $25 до $160+!

---

## 8. Какой уровень выбирать под тип задачи

Для эффективного расходования бюджета применяйте дифференцированный подход к распределению нагрузок.

### 8.1. Стратегии выбора для Fable 5 и Opus

:::tabs
=== Fable 5 (Флагманские задачи)
Начинайте с дефолтного уровня **high**. По глубине рассуждений `high` на Fable 5 превосходит `xhigh` моделей предыдущих поколений. Переключайтесь на `xhigh` только тогда, когда агент решает длительные задачи (>30 мин) или создает архитектуру с чистого листа.
=== Opus 4.8 / 4.7 (Разработка)
Рекомендуемая стартовая конфигурация — **xhigh**. Она в полной мере раскрывает возможности аналитического кодинга Opus. Переходите на `medium` после подтверждения тестов для экономии средств.
=== Фоновые воркеры (low)
Используйте уровень **low** для рутинных задач, парсинга данных, генерации документации и быстрых субагентов, где критична минимальная задержка.
:::

### 8.2. Многоуровневая архитектура: оркестратор и субагенты

Наиболее эффективный паттерн в продакшне — иерархическая структура:
- **Главный оркестратор:** Fable 5 на уровне `high` или `xhigh` (декомпозиция задач, контроль архитектуры, код-ревью).
- **Рабочие субагенты:** Sonnet 4.6 или Fable 5 на уровне `low` (выполнение локальных правок, запуск тестов, рутинные запросы).

---

## 9. Как задать effort на практике: Claude Code и API

Управлять параметром можно как через терминальный интерфейс разработчика, так и программно через Messages API.

### 9.1. Настройка в Claude Code CLI и режим ultracode

Инструмент Claude Code предлагает несколько способов настройки:
- Команда `/effort` открывает интерактивное меню.
- Флаг при запуске: `claude --effort xhigh`.
- Переменная окружения: `export CLAUDE_CODE_EFFORT_LEVEL=xhigh`.

> [!NOTE]
> Режим **ultracode** в меню `/effort` — это внутренняя надстройка Claude Code, объединяющая уровень `xhigh` с постоянным разрешением на выполнение длительных автономных циклов действий.

### 9.2. Вызовы через Messages API и взаимодействие с fast mode

:::tabs
=== Python SDK
```python
import anthropic

client = anthropic.Anthropic()

response = client.messages.create(
    model="claude-fable-5",
    max_tokens=64000,
    output_config={"effort": "xhigh"},
    messages=[
        {"role": "user", "content": "Проведи аудит архитектуры микросервисов"}
    ]
)
print(response.content[0].text)
```
=== TypeScript SDK
```typescript
import Anthropic from "@anthropic-ai/sdk";

const anthropic = new Anthropic();

const response = await anthropic.messages.create({
  model: "claude-fable-5",
  max_tokens: 64000,
  output_config: { effort: "xhigh" },
  messages: [
    { role: "user", content: "Проведи аудит архитектуры микросервисов" }
  ],
});
console.log(response.content[0]);
```
=== cURL (Messages API)
```bash
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-fable-5",
    "max_tokens": 64000,
    "output_config": {"effort": "high"},
    "messages": [{"role": "user", "content": "Hello Fable!"}]
  }'
```
:::

---

## 10. Часто задаваемые вопросы (FAQ)

### 10.1. Доступность уровня xhigh и фолбеки между моделями

> **Вопрос:** Могу ли я использовать `xhigh` на любой модели Claude?  
> **Ответ:** Нет. Уровень `xhigh` доступен исключительно для Fable 5, Mythos 5, Opus 4.8 и Opus 4.7. Если в Claude Code задать `xhigh` для Opus 4.6 или Sonnet 4.6, сессия автоматически откатится к `high`.

### 10.2. Ценообразование за токен против суммарной стоимости

> **Вопрос:** Делает ли выбор высокого уровня `effort` дороже отдельный токен?  
> **Ответ:** Нет, базовая ставка за 1 000 000 токенов фиксирована ($10 вход / $50 выход для Fable 5). Итоговая стоимость возрастает из-за того, что модель генерирует значительно больше скрытых токенов рассуждений и чаще вызывает вспомогательные инструменты.

### 10.3. Отличия ultracode от пользовательской инструкции ultrathink

> **Вопрос:** В чем разница между `ultracode` и ключевым словом `ultrathink`?  
> **Ответ:** `ultracode` — это режим среды Claude Code (уровень `xhigh` + расширенная агентная автономия). В свою очередь, `ultrathink` — это текстовая инструкция в промпте пользователя с просьбой рассуждать глубже на текущем шаге.

### 10.4. Целесообразность постоянной работы на максимальных настройках

> **Вопрос:** Стоит ли всегда запускать Fable 5 на уровне `xhigh`?  
> **Ответ:** Нет. Согласно документации Anthropic, Fable 5 на дефолтном уровне `high` уже превосходит прежние флагманы на максимуме. Постоянный запуск на `xhigh` приводит к заметной задержке ответа и быстрому исчерпанию лимитов без существенного прироста качества на типовых задачах.