Claude Fable 5 — це флагманська модель Anthropic нового класу Mythos, створена для найскладніших багатокрокових задач на міркування та автономної агентної розробки. Разом із цією моделлю розробники отримали новий фундаментальний механізм управління поведінкою — параметр effort.
Цей гайд детально розбирає можливості Fable 5, принципи роботи параметра effort, тарифікацію токенів міркування та практичні стратегії вибору конфігурації для оптимізації швидкості й витрат у продакшні.
1. Fable 5 у двох словах: що це за модель і навіщо вона потрібна
Claude Fable 5 позиціонується як найпотужніша з широко доступних моделей Anthropic, що стоїть вище за рівень Opus. Вона розроблена для задач, де звичайні моделі заходять у глухий кут або втрачають контекст на довгих дистанціях.
1.1. Позиціонування моделі та сімейство Mythos
Fable 5 — це перша загальнодоступна реалізація архітектури класу Mythos. Над нею існує обмежена дослідницька версія — Mythos 5, яка позбавлена додаткових шарів зовнішніх фільтрів і надається виключно авторизованим дослідницьким групам через ініціативу Project Glasswing.
Модель підтримується в середовищі Claude Code та платформі Managed Agents, пропонуючи контекстне вікно в 1 000 000 токенів та генерацію до 128 000 токенів на один запит.
У веб-інтерфейсі Fable 5 доступна для користувачів тарифних планів Pro та Max, а в API викликається за ідентифікатором claude-fable-5.
1.2. Бенчмарки, мультимодальність та концепція No-Slop Code
На тестах Fable 5 демонструє результати рівня State-of-the-Art (SOTA) у складних дисциплінах:
- Агентне програмування: самостійне розгортання репозиторіїв, пошук багів і написання тестів.
- Генерація No-Slop Code: код без надлишкових обгорток, штучних коментарів і сміттєвих абстракцій.
- Мультимодальне сприйняття: проходження ігор (зокрема Pokemon FireRed) виключно за відеопотоком/скріншотами без текстових підказок.
- Наукові дослідження: моделювання в VibeCAD та аналіз біомедичних структур.
Ключова закономірність Fable 5: перевага над Sonnet та Opus стає відчутною саме на довгих, багатокрокових ітераціях.
2. Коли є сенс використовувати Fable 5, а коли — ні
Висока продуктивність моделі супроводжується підвищеною вартістю, тому її застосування має бути економічно та інженерно обґрунтованим.
2.1. Оптимальні та неефективні сценарії використання
Fable 5 створена для задач із високою ціною помилки:
| Рекомендовано використовувати | Не варто переплачувати |
|---|---|
| Комплексний рефакторинг монолітів та міграції систем | Прості CRUD-операції та шаблонні скрипти |
| Багатокрокові агентні сесії (від 20 до 100+ ходів) | Одноразова класифікація або екстракція даних |
| Пошук тонких race condition та проблем безпеки | Написання простих юніт-тестів для відомих функцій |
| Архітектурне проектування нових підсистем | Швидка суммаризація коротких нотаток |
2.2. Чотири правила підготовки до продакшну та параметри доступу
Перед інтеграцією Fable 5 у ваші пайплайни врахуйте такі інженерні аспекти:
- Спрощуйте системні промпти: Fable 5 мислить концептуально. Жорсткі покрокові скрипти зі старих моделей лише обмежують її потенціал — задавайте кінцеву мету та межі допустимого.
- Керуйте параметром effort: Налаштування зусиль — головний важіль контролю затримки (latency) та фінансових витрат.
- Закладайте таймаути на довгі ходи: Складні міркування на фронтирних задачах можуть займати хвилини; обмежуйте максимальні ітерації агентів.
- Обробляйте відмови (Refusals): Через суворі внутрішні правила безпеки частина граничних запитів повертає відмову, що вимагає наявності резервної обробки в коді.
3. Що взагалі робить effort і як він працює
З появою Fable 5 інженери Anthropic кардинально переглянули систему налаштувань. Звичні параметри семплінгу (температура, top-p) та ручний budget_tokens відійшли в минуле.
3.1. Механізм поведінкового сигналу vs фіксований бюджет токенів
Головним інструментом тонкого налаштування став параметр effort, який передається всередині конфігурації виводу: output_config={"effort": "..."}.
Параметр effort — це якісний поведінковий сигнал, а не жорсткий ліміт токенів. Він повідомляє моделі, наскільки глибоко досліджувати простір гіпотез і скільки зусиль докладати до верифікації. Жорсткою межею генерації залишається тільки max_tokens.
3.2. Вплив на виклики інструментів, пояснення та генерацію
На відміну від застарілого budget_tokens, який керував лише фазою внутрішнього міркування, effort масштабує всі аспекти відповіді:
- На рівні low: модель генерує менше викликів інструментів, групує команди в один запит, мінімізує вступні формулювання і повертає лаконічний результат.
- На рівні high / xhigh: модель розгортає внутрішній план, перевіряє проміжні результати додатковими інструментами та надає вичерпні коментарі.
4. П'ять рівнів effort і де який доступний
Messages API підтримує фіксований список із п'яти допустимих значень параметра effort.
4.1. Офіційна шкала від low до xhigh
| Рівень | Поведінковий опис за документацією Anthropic | Доступність у сімействі моделей |
|---|---|---|
| xhigh | Максимальна глибина міркування для довгих агентних сесій (>30 хв) із мільйонними бюджетами | Тільки Fable 5, Mythos 5, Opus 4.8, Opus 4.7 |
| high | Значення за замовчуванням: розгорнуте міркування, планування та перевірка кроків | Усі моделі з підтримкою effort |
| medium | Збалансований рівень із помірною економією токенів без втрати логіки | Усі моделі з підтримкою effort |
| low | Максимальна швидкість та мінімальні витрати токенів при базовому контролі якості | Усі моделі з підтримкою effort |
| max | Екстремальне, безлімітне міркування для специфічних наукових задач | Спеціальні сесії Claude Code |
4.2. Підтримка за моделями та індивідуальне калібрування
Рівень xhigh є ексклюзивним: на Opus 4.6 та Sonnet 4.6 цей рівень відсутній. Більше того, шкала зусиль калібрується для кожної нейромережі окремо: high для Fable 5 генерує значно глибшу траєкторію міркувань, ніж high для Opus 4.6.
5. Дефолти за моделями та різними середовищами: API і Claude Code
Поведінка моделі без явного зазначення параметрів відрізняється залежно від середовища виконання.
5.1. Порівняння значень за замовчуванням в API та Claude Code
| Модель | Дефолт у Messages API | Дефолт у Claude Code |
|---|---|---|
| Claude Fable 5 | high | high |
| Claude Opus 4.8 | high | high |
| Claude Opus 4.7 | high | xhigh |
| Claude Opus 4.6 / Sonnet 4.6 | high | high |
5.2. Поведінка фолбеків та збереження стану між сесіями
- Автоматичний відкат (Fallback): Якщо ви викликали сесію з рівнем
xhigh, а потім перемкнулися на Opus 4.6, Claude Code автоматично відкочується доhighбез аварійної зупинки. - Персистентність рівнів: Рівні від
lowдоxhighзберігаються між запусками Claude Code. Рівеньmaxнавмисно скидається після завершення сесії, щоб запобігти неконтрольованому спалюванню бюджету користувача.
6. Як effort пов'язаний з міркуванням моделі
Робота з внутрішнім міркуванням (Thinking) кардинально відрізняється між генераціями моделей.
6.1. Особливості Fable 5 проти адаптивного режиму в Opus
- Fable 5: Міркування вбудоване в архітектуру і ввімкнене постійно. Спроба передати
thinking: {"type": "disabled"}повертає помилкуHTTP 400 Bad Request. - Opus 4.7 / 4.8: Адаптивне міркування вимкнено за замовчуванням і активується викликом
thinking: {"type": "adaptive"}.
6.2. Міграція з застарілого параметра budget_tokens
Якщо ви оновлюєте кодову базу з попередніх версій Claude SDK, параметр budget_tokens більше не підтримується. Його використання поверне помилку API. Замініть його на об'єкт output_config={"effort": "..."}.
7. У скільки обходиться кожен рівень: розрахунок вартості
Параметр effort не змінює базову ставку за мільйон токенів. Він впливає на фінальний рахунок опосередковано — через кількість згенерованих токенів міркування.
7.1. Тарифікація прихованих токенів міркування (Thinking Tokens)
На Fable 5 за замовчуванням вивід тексту міркування приховано (omitted), проте кожен токен внутрішніх роздумів тарифікується як повноцінний вихідний токен за стандартною ставкою: $10 за 1 млн вхідних токенів та $50 за 1 млн вихідних токенів.
7.2. Розрахунок вартості на хід та вплив нового токенізатора
Оцінка вартості одного ходу в агентному завданні при 20 000 вхідних токенах (на прикладі Opus 4.8):
| Сценарій і рівень | Токени виводу | Вхід ($5/M) | Вихід ($25/M) | Підсумок за 1 хід |
|---|---|---|---|---|
| low (лаконічно, стислі інструменти) | 5 000 | $0,10 | $0,125 | ~$0,23 |
| high (планування, валідація коду) | 20 000 | $0,10 | $0,50 | ~$0,60 |
| xhigh (глибоке дослідження архітектури) | 60 000 | $0,10 | $1,50 | ~$1,60 |
Для Fable 5 помножте ці цифри на 2 (вихід $50/M). Різниця між low та xhigh на довгій агентній сесії у 50 ходів може становити від $25 до $160!
8. Який рівень обирати під тип задачі
Щоб не перевитрачати бюджет, використовуйте диференційований підхід до розподілу навантаження.
8.1. Стратегії вибору для Fable 5 та Opus
Починайте роботу з дефолтного рівня high. Рівень high на Fable 5 перевершує за якістю xhigh попередніх поколінь моделей. Переходьте на xhigh лише тоді, коли агент вирішує завдання тривалістю понад 30 хвилин або проектує нову архітектуру з нуля.
8.2. Багаторівнева архітектура: оркестратор і субагенти
Найефективніший патерн у продакшні — ієрархія агентів:
- Головний оркестратор: Fable 5 на рівні
highабоxhigh(будує дерево завдань і валідує код). - Робочі субагенти: Sonnet 4.6 або Fable 5 на рівні
low(швидко виконують локальні ізольовані правки).
9. Як задати effort на практиці: Claude Code та API
Керувати параметром можна як через CLI-інтерфейс розробника, так і програмно через Messages API.
9.1. Налаштування в Claude Code CLI та режим ultracode
Утиліта Claude Code надає гнучкі можливості керування:
- Команда
/effortвикликає інтерактивне меню. - Прапорець запуску:
claude --effort xhigh. - Змінна середовища:
export CLAUDE_CODE_EFFORT_LEVEL=xhigh.
Режим ultracode у меню /effort — це внутрішній режим Claude Code, який поєднує рівень xhigh із розширеними правами оркестратора на виконання довгих автономних циклів дій.
9.2. Виклики через Messages API та взаємодія з fast mode
pythonimport anthropic client = anthropic.Anthropic() response = client.messages.create( model="claude-fable-5", max_tokens=64000, output_config={"effort": "xhigh"}, messages=[ {"role": "user", "content": "Проведи аудит архітектури мікросервісів"} ] ) print(response.content[0].text)
10. Часті запитання (FAQ)
10.1. Доступність рівня xhigh та фолбеки між моделями
Питання: Чи можу я використовувати
xhighна всіх моделях Claude?
Відповідь: Ні. Рівеньxhighдоступний виключно для Fable 5, Mythos 5, Opus 4.8 та Opus 4.7. Якщо в Claude Code обратиxhighдля Opus 4.6 або Sonnet 4.6, система автоматично виконає запит на рівніhigh.
10.2. Ціноутворення за токен проти сумарної вартості
Питання: Чи підвищує рівень
effortвартість одного токена?
Відповідь: Ні, ціна за 1 000 000 токенів фіксована ($10 вхід / $50 вихід для Fable 5). Більша вартість запиту зумовлена виключно тим, що модель генерує більше прихованих токенів міркування та виконує більше викликів інструментів.
10.3. Відмінності ultracode від системної інструкції ultrathink
Питання: У чому різниця між
ultracodeтаultrathink?
Відповідь:ultracode— це конфігурація середовища Claude Code (рівеньxhigh+ розширені права автономності). Своєю чергою,ultrathink— це текстовий промпт-тригер користувача всередині чату з проханням міркувати максимально глибоко на поточному ході.
10.4. Доцільність постійної роботи на максимальних налаштуваннях
Питання: Чи варто завжди вмикати Fable 5 на рівень
xhigh?
Відповідь: Ні. За даними розробників Anthropic, Fable 5 на рівніhighвже перевершує попередні флагмани на максимумі. Постійна робота наxhighпризводить до відчутної затримки та швидкого вичерпання лімітів без істотного приросту якості на звичайних задачах.