Skip to main content
Зміст гайду

Зміст гайду

Час на вивчення: 15 хв
#ai_models#claude#fable#model#effort
Середній15 хв

Claude Fable 5: коли використовувати потужну модель і який рівень effort обрати

Повний розбір моделі Claude Fable 5 та параметру effort: як працює поведінковий сигнал міркування, матриця доступності рівнів (low/xhigh), розрахунок вартості за хід та налаштування в API і Claude Code.

Опубліковано:

Claude Fable 5 — це флагманська модель Anthropic нового класу Mythos, створена для найскладніших багатокрокових задач на міркування та автономної агентної розробки. Разом із цією моделлю розробники отримали новий фундаментальний механізм управління поведінкою — параметр effort.

Цей гайд детально розбирає можливості Fable 5, принципи роботи параметра effort, тарифікацію токенів міркування та практичні стратегії вибору конфігурації для оптимізації швидкості й витрат у продакшні.


1. Fable 5 у двох словах: що це за модель і навіщо вона потрібна

Claude Fable 5 позиціонується як найпотужніша з широко доступних моделей Anthropic, що стоїть вище за рівень Opus. Вона розроблена для задач, де звичайні моделі заходять у глухий кут або втрачають контекст на довгих дистанціях.

1.1. Позиціонування моделі та сімейство Mythos

Fable 5 — це перша загальнодоступна реалізація архітектури класу Mythos. Над нею існує обмежена дослідницька версія — Mythos 5, яка позбавлена додаткових шарів зовнішніх фільтрів і надається виключно авторизованим дослідницьким групам через ініціативу Project Glasswing.

Модель підтримується в середовищі Claude Code та платформі Managed Agents, пропонуючи контекстне вікно в 1 000 000 токенів та генерацію до 128 000 токенів на один запит.

Примітка

У веб-інтерфейсі Fable 5 доступна для користувачів тарифних планів Pro та Max, а в API викликається за ідентифікатором claude-fable-5.

1.2. Бенчмарки, мультимодальність та концепція No-Slop Code

На тестах Fable 5 демонструє результати рівня State-of-the-Art (SOTA) у складних дисциплінах:

  • Агентне програмування: самостійне розгортання репозиторіїв, пошук багів і написання тестів.
  • Генерація No-Slop Code: код без надлишкових обгорток, штучних коментарів і сміттєвих абстракцій.
  • Мультимодальне сприйняття: проходження ігор (зокрема Pokemon FireRed) виключно за відеопотоком/скріншотами без текстових підказок.
  • Наукові дослідження: моделювання в VibeCAD та аналіз біомедичних структур.

Ключова закономірність Fable 5: перевага над Sonnet та Opus стає відчутною саме на довгих, багатокрокових ітераціях.


2. Коли є сенс використовувати Fable 5, а коли — ні

Висока продуктивність моделі супроводжується підвищеною вартістю, тому її застосування має бути економічно та інженерно обґрунтованим.

2.1. Оптимальні та неефективні сценарії використання

Fable 5 створена для задач із високою ціною помилки:

Рекомендовано використовуватиНе варто переплачувати
Комплексний рефакторинг монолітів та міграції системПрості CRUD-операції та шаблонні скрипти
Багатокрокові агентні сесії (від 20 до 100+ ходів)Одноразова класифікація або екстракція даних
Пошук тонких race condition та проблем безпекиНаписання простих юніт-тестів для відомих функцій
Архітектурне проектування нових підсистемШвидка суммаризація коротких нотаток

2.2. Чотири правила підготовки до продакшну та параметри доступу

Перед інтеграцією Fable 5 у ваші пайплайни врахуйте такі інженерні аспекти:

  1. Спрощуйте системні промпти: Fable 5 мислить концептуально. Жорсткі покрокові скрипти зі старих моделей лише обмежують її потенціал — задавайте кінцеву мету та межі допустимого.
  2. Керуйте параметром effort: Налаштування зусиль — головний важіль контролю затримки (latency) та фінансових витрат.
  3. Закладайте таймаути на довгі ходи: Складні міркування на фронтирних задачах можуть займати хвилини; обмежуйте максимальні ітерації агентів.
  4. Обробляйте відмови (Refusals): Через суворі внутрішні правила безпеки частина граничних запитів повертає відмову, що вимагає наявності резервної обробки в коді.

3. Що взагалі робить effort і як він працює

З появою Fable 5 інженери Anthropic кардинально переглянули систему налаштувань. Звичні параметри семплінгу (температура, top-p) та ручний budget_tokens відійшли в минуле.

3.1. Механізм поведінкового сигналу vs фіксований бюджет токенів

Головним інструментом тонкого налаштування став параметр effort, який передається всередині конфігурації виводу: output_config={"effort": "..."}.

Важливо

Параметр effort — це якісний поведінковий сигнал, а не жорсткий ліміт токенів. Він повідомляє моделі, наскільки глибоко досліджувати простір гіпотез і скільки зусиль докладати до верифікації. Жорсткою межею генерації залишається тільки max_tokens.

3.2. Вплив на виклики інструментів, пояснення та генерацію

На відміну від застарілого budget_tokens, який керував лише фазою внутрішнього міркування, effort масштабує всі аспекти відповіді:

  • На рівні low: модель генерує менше викликів інструментів, групує команди в один запит, мінімізує вступні формулювання і повертає лаконічний результат.
  • На рівні high / xhigh: модель розгортає внутрішній план, перевіряє проміжні результати додатковими інструментами та надає вичерпні коментарі.

4. П'ять рівнів effort і де який доступний

Messages API підтримує фіксований список із п'яти допустимих значень параметра effort.

4.1. Офіційна шкала від low до xhigh

РівеньПоведінковий опис за документацією AnthropicДоступність у сімействі моделей
xhighМаксимальна глибина міркування для довгих агентних сесій (>30 хв) із мільйонними бюджетамиТільки Fable 5, Mythos 5, Opus 4.8, Opus 4.7
highЗначення за замовчуванням: розгорнуте міркування, планування та перевірка кроківУсі моделі з підтримкою effort
mediumЗбалансований рівень із помірною економією токенів без втрати логікиУсі моделі з підтримкою effort
lowМаксимальна швидкість та мінімальні витрати токенів при базовому контролі якостіУсі моделі з підтримкою effort
maxЕкстремальне, безлімітне міркування для специфічних наукових задачСпеціальні сесії Claude Code

4.2. Підтримка за моделями та індивідуальне калібрування

Рівень xhigh є ексклюзивним: на Opus 4.6 та Sonnet 4.6 цей рівень відсутній. Більше того, шкала зусиль калібрується для кожної нейромережі окремо: high для Fable 5 генерує значно глибшу траєкторію міркувань, ніж high для Opus 4.6.


5. Дефолти за моделями та різними середовищами: API і Claude Code

Поведінка моделі без явного зазначення параметрів відрізняється залежно від середовища виконання.

5.1. Порівняння значень за замовчуванням в API та Claude Code

МодельДефолт у Messages APIДефолт у Claude Code
Claude Fable 5highhigh
Claude Opus 4.8highhigh
Claude Opus 4.7highxhigh
Claude Opus 4.6 / Sonnet 4.6highhigh

5.2. Поведінка фолбеків та збереження стану між сесіями

  • Автоматичний відкат (Fallback): Якщо ви викликали сесію з рівнем xhigh, а потім перемкнулися на Opus 4.6, Claude Code автоматично відкочується до high без аварійної зупинки.
  • Персистентність рівнів: Рівні від low до xhigh зберігаються між запусками Claude Code. Рівень max навмисно скидається після завершення сесії, щоб запобігти неконтрольованому спалюванню бюджету користувача.

6. Як effort пов'язаний з міркуванням моделі

Робота з внутрішнім міркуванням (Thinking) кардинально відрізняється між генераціями моделей.

6.1. Особливості Fable 5 проти адаптивного режиму в Opus

  • Fable 5: Міркування вбудоване в архітектуру і ввімкнене постійно. Спроба передати thinking: {"type": "disabled"} повертає помилку HTTP 400 Bad Request.
  • Opus 4.7 / 4.8: Адаптивне міркування вимкнено за замовчуванням і активується викликом thinking: {"type": "adaptive"}.

6.2. Міграція з застарілого параметра budget_tokens

Увага

Якщо ви оновлюєте кодову базу з попередніх версій Claude SDK, параметр budget_tokens більше не підтримується. Його використання поверне помилку API. Замініть його на об'єкт output_config={"effort": "..."}.


7. У скільки обходиться кожен рівень: розрахунок вартості

Параметр effort не змінює базову ставку за мільйон токенів. Він впливає на фінальний рахунок опосередковано — через кількість згенерованих токенів міркування.

7.1. Тарифікація прихованих токенів міркування (Thinking Tokens)

На Fable 5 за замовчуванням вивід тексту міркування приховано (omitted), проте кожен токен внутрішніх роздумів тарифікується як повноцінний вихідний токен за стандартною ставкою: $10 за 1 млн вхідних токенів та $50 за 1 млн вихідних токенів.

7.2. Розрахунок вартості на хід та вплив нового токенізатора

Оцінка вартості одного ходу в агентному завданні при 20 000 вхідних токенах (на прикладі Opus 4.8):

Сценарій і рівеньТокени виводуВхід ($5/M)Вихід ($25/M)Підсумок за 1 хід
low (лаконічно, стислі інструменти)5 000$0,10$0,125~$0,23
high (планування, валідація коду)20 000$0,10$0,50~$0,60
xhigh (глибоке дослідження архітектури)60 000$0,10$1,50~$1,60
Порада

Для Fable 5 помножте ці цифри на 2 (вихід $50/M). Різниця між low та xhigh на довгій агентній сесії у 50 ходів може становити від $25 до $160!


8. Який рівень обирати під тип задачі

Щоб не перевитрачати бюджет, використовуйте диференційований підхід до розподілу навантаження.

8.1. Стратегії вибору для Fable 5 та Opus

Починайте роботу з дефолтного рівня high. Рівень high на Fable 5 перевершує за якістю xhigh попередніх поколінь моделей. Переходьте на xhigh лише тоді, коли агент вирішує завдання тривалістю понад 30 хвилин або проектує нову архітектуру з нуля.

8.2. Багаторівнева архітектура: оркестратор і субагенти

Найефективніший патерн у продакшні — ієрархія агентів:

  • Головний оркестратор: Fable 5 на рівні high або xhigh (будує дерево завдань і валідує код).
  • Робочі субагенти: Sonnet 4.6 або Fable 5 на рівні low (швидко виконують локальні ізольовані правки).

9. Як задати effort на практиці: Claude Code та API

Керувати параметром можна як через CLI-інтерфейс розробника, так і програмно через Messages API.

9.1. Налаштування в Claude Code CLI та режим ultracode

Утиліта Claude Code надає гнучкі можливості керування:

  • Команда /effort викликає інтерактивне меню.
  • Прапорець запуску: claude --effort xhigh.
  • Змінна середовища: export CLAUDE_CODE_EFFORT_LEVEL=xhigh.
Примітка

Режим ultracode у меню /effort — це внутрішній режим Claude Code, який поєднує рівень xhigh із розширеними правами оркестратора на виконання довгих автономних циклів дій.

9.2. Виклики через Messages API та взаємодія з fast mode

python
import anthropic client = anthropic.Anthropic() response = client.messages.create( model="claude-fable-5", max_tokens=64000, output_config={"effort": "xhigh"}, messages=[ {"role": "user", "content": "Проведи аудит архітектури мікросервісів"} ] ) print(response.content[0].text)

10. Часті запитання (FAQ)

10.1. Доступність рівня xhigh та фолбеки між моделями

Питання: Чи можу я використовувати xhigh на всіх моделях Claude?
Відповідь: Ні. Рівень xhigh доступний виключно для Fable 5, Mythos 5, Opus 4.8 та Opus 4.7. Якщо в Claude Code обрати xhigh для Opus 4.6 або Sonnet 4.6, система автоматично виконає запит на рівні high.

10.2. Ціноутворення за токен проти сумарної вартості

Питання: Чи підвищує рівень effort вартість одного токена?
Відповідь: Ні, ціна за 1 000 000 токенів фіксована ($10 вхід / $50 вихід для Fable 5). Більша вартість запиту зумовлена виключно тим, що модель генерує більше прихованих токенів міркування та виконує більше викликів інструментів.

10.3. Відмінності ultracode від системної інструкції ultrathink

Питання: У чому різниця між ultracode та ultrathink?
Відповідь: ultracode — це конфігурація середовища Claude Code (рівень xhigh + розширені права автономності). Своєю чергою, ultrathink — це текстовий промпт-тригер користувача всередині чату з проханням міркувати максимально глибоко на поточному ході.

10.4. Доцільність постійної роботи на максимальних налаштуваннях

Питання: Чи варто завжди вмикати Fable 5 на рівень xhigh?
Відповідь: Ні. За даними розробників Anthropic, Fable 5 на рівні high вже перевершує попередні флагмани на максимумі. Постійна робота на xhigh призводить до відчутної затримки та швидкого вичерпання лімітів без істотного приросту якості на звичайних задачах.

Цей гайд повністю безкоштовний. Якщо він зекономив вам вечір — ви можете підтримати розвиток проєкту.
Підтримати автора