Claude Fable 5 — флагманская модель Anthropic нового класса Mythos, созданная для сложнейших многошаговых задач на рассуждения и автономной агентной разработки. Вместе с этой моделью разработчики получили новый фундаментальный инструмент управления поведением — параметр effort.
Этот гайд детально разбирает возможности Fable 5, принципы работы параметра effort, тарификацию токенов рассуждений и практические стратегии выбора конфигураций для баланса скорости, точности и бюджета в продакшне.
1. Fable 5 в двух словах: что это за модель и зачем она нужна
Claude Fable 5 позиционируется как самая мощная из широко доступных моделей Anthropic, находящаяся выше уровня Opus. Она разработана для сценариев, где стандартные модели заходят в тупик или теряют нить контекста на длинных дистанциях.
1.1. Позиционирование модели и семейство Mythos
Fable 5 — первая массовая реализация архитектуры класса Mythos. Над ней существует закрытая исследовательская версия — Mythos 5, лишенная внешних фильтров безопасности и предоставляемая исключительно авторизованным академическим группам через инициативу Project Glasswing.
Модель поддерживается в среде Claude Code и на платформе Managed Agents, предоставляя контекстное окно в 1 000 000 токенов и генерацию до 128 000 токенов на один запрос.
В веб-интерфейсе Fable 5 доступна для пользователей подписок Pro и Max, а в API вызывается по идентификатору claude-fable-5.
1.2. Бенчмарки, мультимодальность и концепция No-Slop Code
На сравнительных тестах Fable 5 демонстрирует результаты уровня State-of-the-Art (SOTA) в сложнейших дисциплинах:
- Агентное программирование: автономное развертывание проектов, локализация багов и генерация тестов.
- Генерация No-Slop Code: чистый идиоматичный код без избыточных оберток, искусственных комментариев и мусорных абстракций.
- Мультимодальное восприятие: прохождение игр (включая Pokemon FireRed) исключительно по видеоряду/скриншотам без текстовых подсказок.
- Научное моделирование: параметрическое проектирование в VibeCAD и биомедицинский анализ.
Главная закономерность Fable 5: качественный отрыв от Sonnet и Opus многократно возрастает на длительных многоходовых итерациях.
2. Когда есть смысл использовать Fable 5, а когда — нет
Высокая вычислительная мощность модели сопровождается повышенной стоимостью и задержкой, поэтому ее внедрение требует взвешенного инженерного подхода.
2.1. Оптимальные и неэффективные сценарии использования
Fable 5 раскрывает потенциал там, где цена ошибки или человеческого вмешательства высока:
| Рекомендуется использовать | Неоправданная переплата |
|---|---|
| Глубокий рефакторинг монолитных систем и миграции кодовых баз | Шаблонные CRUD-операции и простые скрипты |
| Длинные агентные прогоны (от 20 до 100+ последовательных ходов) | Однократная классификация текста или извлечение сущностей |
| Поиск скрытых race condition и уязвимостей безопасности | Написание тривиальных юнит-тестов для базовых функций |
| Архитектурное проектирование новых подсистем с нуля | Быстрая суммаризация коротких писем или заметок |
2.2. Четыре правила подготовки к продакшну и параметры доступа
Перед интеграцией Fable 5 в рабочие процессы учтите четыре ключевых фактора:
- Упрощайте системные промпты: Fable 5 отлично оперирует абстрактными целями. Жесткие пошаговые инструкции от старых моделей сковывают рассуждения — задавайте конечный результат и границы дозволенного.
- Управляйте параметром effort: Настройка усилий — главный рычаг контроля задержки (latency) и расходов на токены.
- Закладывайте тайм-ауты на длинные ходы: Сложные рассуждения могут занимать минуты; строго ограничивайте число циклов агента.
- Обрабатывайте отказы (Refusals): Из-за строгих фильтров безопасности пограничные запросы могут возвращать отказ, требующий резервных сценариев обработки в коде.
3. Что вообще делает effort и как он работает
С выходом Fable 5 команда Anthropic отказалась от привычных параметров семплирования (температура, top-p) и ручного управления через budget_tokens.
3.1. Механизм поведенческого сигнала vs жесткий бюджет токенов
Ключевым инструментом настройки стал параметр effort, передаваемый внутри конфигурации вывода: output_config={"effort": "..."}.
Параметр effort — это качественный поведенческий сигнал, а не фиксированный лимит токенов. Он сообщает модели, насколько глубоко исследовать пространство гипотез. Единственным жестким потолком генерации остается max_tokens.
3.2. Влияние на вызовы инструментов, пояснения и генерацию
В отличие от устаревшего budget_tokens, который ограничивал только фазу внутренних рассуждений, effort масштабирует поведение модели целиком:
- На уровне low: модель делает меньше вызовов инструментов, объединяет команды в один запрос, опускает вводные формулировки и отвечает максимально кратко.
- На уровне high / xhigh: модель подробно расписывает план действий, перепроверяет результаты дополнительными инструментами и дает исчерпывающие комментарии к коду.
4. Пять уровней effort и где какой доступен
Messages API поддерживает фиксированный перечень из пяти допустимых строковых значений параметра effort.
4.1. Официальная шкала от low до xhigh
| Уровень | Поведенческое описание по документации Anthropic | Доступность в модельном ряду |
|---|---|---|
| xhigh | Максимальная глубина рассуждений для длительных сессий (>30 мин) с миллионными бюджетами | Только Fable 5, Mythos 5, Opus 4.8, Opus 4.7 |
| high | Значение по умолчанию: развернутые рассуждения, планирование и перепроверка шагов | Все модели с поддержкой effort |
| medium | Сбалансированный уровень с умеренной экономией токенов без потери логики | Все модели с поддержкой effort |
| low | Максимальная скорость и минимальный расход токенов при базовом контроле качества | Все модели с поддержкой effort |
| max | Экстремальные, неограниченные рассуждения для фронтирных исследовательских задач | Специальные сессии Claude Code |
4.2. Поддержка по моделям и индивидуальная калибровка
Уровень xhigh является эксклюзивным: на Opus 4.6 и Sonnet 4.6 он отсутствует. Кроме того, шкала усилий калибруется индивидуально для каждой модели: уровень high на Fable 5 генерирует намного более глубокую цепочку рассуждений, чем high на Opus 4.6.
5. Дефолты по моделям и разным средам: API и Claude Code
Поведение модели без явного указания параметров различается в зависимости от среды вызова.
5.1. Сравнение значений по умолчанию в API и Claude Code
| Модель | Дефолт в Messages API | Дефолт в Claude Code |
|---|---|---|
| Claude Fable 5 | high | high |
| Claude Opus 4.8 | high | high |
| Claude Opus 4.7 | high | xhigh |
| Claude Opus 4.6 / Sonnet 4.6 | high | high |
5.2. Поведение фолбеков и сохранение состояния между сессиями
- Автоматический откат (Fallback): Если вы указали
xhigh, а затем переключились на модель Opus 4.6, Claude Code автоматически применит уровеньhighбез генерации ошибки. - Сохранение настроек: Значения от
lowдоxhighсохраняются между запусками Claude Code. Уровеньmaxдействует только в рамках текущей сессии, предотвращая случайный перерасход средств.
6. Как effort связан с рассуждениями модели
Механика работы внутреннего мышления (Thinking) кардинально различается между поколениями моделей.
6.1. Особенности Fable 5 против адаптивного режима в Opus
- Fable 5: Рассуждения вшиты в архитектуру и включены постоянно. Попытка передать
thinking: {"type": "disabled"}возвращает ошибкуHTTP 400 Bad Request. - Opus 4.7 / 4.8: Адаптивное мышление отключено по умолчанию и активируется параметром
thinking: {"type": "adaptive"}.
6.2. Миграция с устаревшего параметра budget_tokens
Если вы обновляете кодовую базу с более ранних версий Claude SDK, параметр budget_tokens больше не поддерживается и вызовет ошибку API. Замените его на объект output_config={"effort": "..."}.
7. Во сколько обходится каждый уровень: расчет стоимости
Параметр effort не меняет базовый тариф за 1 млн токенов. Он влияет на стоимость косвенно — через объем сгенерированных токенов рассуждений.
7.1. Тарификация скрытых токенов рассуждений (Thinking Tokens)
На Fable 5 текст рассуждений по умолчанию скрыт (omitted), однако каждый сгенерированный токен мыслительного процесса оплачивается как стандартный выходной токен: $10 за 1 млн входных и $50 за 1 млн выходных токенов.
7.2. Расчет стоимости на ход и влияние нового токенизатора
Оценка затрат на один ход в агентном сценарии при 20 000 входных токенов (на примере Opus 4.8 с тарифом $5/$25):
| Сценарий и уровень | Токены вывода | Вход ($5/M) | Выход ($25/M) | Итого за 1 ход |
|---|---|---|---|---|
| low (кратко, минимум инструментов) | 5 000 | $0,10 | $0,125 | ~$0,23 |
| high (планирование, валидация) | 20 000 | $0,10 | $0,50 | ~$0,60 |
| xhigh (глубокий архитектурный анализ) | 60 000 | $0,10 | $1,50 | ~$1,60 |
Для Fable 5 умножьте эти значения на 2 (выход $50/M). Разница между low и xhigh на длинной сессии из 50 ходов может составить от $25 до $160+!
8. Какой уровень выбирать под тип задачи
Для эффективного расходования бюджета применяйте дифференцированный подход к распределению нагрузок.
8.1. Стратегии выбора для Fable 5 и Opus
Начинайте с дефолтного уровня high. По глубине рассуждений high на Fable 5 превосходит xhigh моделей предыдущих поколений. Переключайтесь на xhigh только тогда, когда агент решает длительные задачи (>30 мин) или создает архитектуру с чистого листа.
8.2. Многоуровневая архитектура: оркестратор и субагенты
Наиболее эффективный паттерн в продакшне — иерархическая структура:
- Главный оркестратор: Fable 5 на уровне
highилиxhigh(декомпозиция задач, контроль архитектуры, код-ревью). - Рабочие субагенты: Sonnet 4.6 или Fable 5 на уровне
low(выполнение локальных правок, запуск тестов, рутинные запросы).
9. Как задать effort на практике: Claude Code и API
Управлять параметром можно как через терминальный интерфейс разработчика, так и программно через Messages API.
9.1. Настройка в Claude Code CLI и режим ultracode
Инструмент Claude Code предлагает несколько способов настройки:
- Команда
/effortоткрывает интерактивное меню. - Флаг при запуске:
claude --effort xhigh. - Переменная окружения:
export CLAUDE_CODE_EFFORT_LEVEL=xhigh.
Режим ultracode в меню /effort — это внутренняя надстройка Claude Code, объединяющая уровень xhigh с постоянным разрешением на выполнение длительных автономных циклов действий.
9.2. Вызовы через Messages API и взаимодействие с fast mode
pythonimport anthropic client = anthropic.Anthropic() response = client.messages.create( model="claude-fable-5", max_tokens=64000, output_config={"effort": "xhigh"}, messages=[ {"role": "user", "content": "Проведи аудит архитектуры микросервисов"} ] ) print(response.content[0].text)
10. Часто задаваемые вопросы (FAQ)
10.1. Доступность уровня xhigh и фолбеки между моделями
Вопрос: Могу ли я использовать
xhighна любой модели Claude?
Ответ: Нет. Уровеньxhighдоступен исключительно для Fable 5, Mythos 5, Opus 4.8 и Opus 4.7. Если в Claude Code задатьxhighдля Opus 4.6 или Sonnet 4.6, сессия автоматически откатится кhigh.
10.2. Ценообразование за токен против суммарной стоимости
Вопрос: Делает ли выбор высокого уровня
effortдороже отдельный токен?
Ответ: Нет, базовая ставка за 1 000 000 токенов фиксирована ($10 вход / $50 выход для Fable 5). Итоговая стоимость возрастает из-за того, что модель генерирует значительно больше скрытых токенов рассуждений и чаще вызывает вспомогательные инструменты.
10.3. Отличия ultracode от пользовательской инструкции ultrathink
Вопрос: В чем разница между
ultracodeи ключевым словомultrathink?
Ответ:ultracode— это режим среды Claude Code (уровеньxhigh+ расширенная агентная автономия). В свою очередь,ultrathink— это текстовая инструкция в промпте пользователя с просьбой рассуждать глубже на текущем шаге.
10.4. Целесообразность постоянной работы на максимальных настройках
Вопрос: Стоит ли всегда запускать Fable 5 на уровне
xhigh?
Ответ: Нет. Согласно документации Anthropic, Fable 5 на дефолтном уровнеhighуже превосходит прежние флагманы на максимуме. Постоянный запуск наxhighприводит к заметной задержке ответа и быстрому исчерпанию лимитов без существенного прироста качества на типовых задачах.