Блог

Руководство по промптингу Fable 5.1: уровни effort, адаптивные рассуждения и агентные паттерны

Короткий ответ

С выходом Fable 5.1 промптинг изменился: адаптивные рассуждения включены всегда, так что переключателя extended thinking больше нет. Ваш главный рычаг управления теперь — уровень effort: LOW, MEDIUM, HIGH, XHIGH или MAX. Официальная рекомендация Anthropic: начинайте со значения по умолчанию (High) и проверяйте более низкие и более высокие уровни на собственных эвалах, а не гадайте. Всё остальное — чёткие инструкции, стабильные кэшируемые префиксы, направляющие указания вместо принудительного вызова инструментов — важно не меньше, чем в Fable 5, а теперь окупается вдвойне благодаря чтению из кэша по $0.25/M.

Пять уровней effort

Effort Глубина рассуждений Стоимость / задержка Где по умолчанию Для чего подходит
LOW Минимум размышлений Дешевле и быстрее всего Извлечение данных, форматирование, простые переписывания
MEDIUM Умеренная Низкие claude.ai, Claude Cowork Рутинные вопросы и ответы, короткие правки кода
HIGH Полные адаптивные рассуждения Умеренные API, Claude Code Вариант по умолчанию для большинства задач разработки
XHIGH Расширенная Высокие Сложная отладка, архитектура, многошаговая математика
MAX Максимальный бюджет Наивысшие Задачи исследовательского уровня, где оправданы и минуты, и доллары

Значения по умолчанию говорят сами за себя: Anthropic выбрала High для API и Claude Code (работа, за которую вы платите по токенам) и Medium для claude.ai и Claude Cowork (интерактивный чат, где важна скорость). Effort можно менять прямо посреди диалога — поднимайте его, когда шаг становится трудным, и снижайте, когда план уже определён.

Официальная рекомендация: начинайте с High, затем измеряйте

Документация Anthropic по промптингу Fable 5.1 на редкость прямолинейна: effort — главный рычаг, по умолчанию ставьте High и проверяйте low/medium/xhigh/max на собственных эвалах. Не по ощущениям, а на наборе задач, где корректность можно оценить. Причина вот в чём: при адаптивных рассуждениях модель сама решает, сколько думать в пределах уровня effort, так что рычаг, который вы поворачиваете, — это потолок бюджета, а правильный потолок зависит от конкретной нагрузки.

Практический цикл:

  1. Соберите эвал из 20–50 кейсов под вашу задачу (подойдёт даже таблица с отметками «прошёл/не прошёл»).
  2. Прогоните его на HIGH — это базовая линия.
  3. Попробуйте MEDIUM и XHIGH. Если MEDIUM даёт тот же результат при ощутимо меньшей стоимости — используйте его. Если XHIGH исправляет реальные провалы — оставьте его для этих классов ошибок.
  4. Возвращайтесь к этому раз в квартал: обновления модели сдвигают оптимум.

Medium или High: правило выбора

Вопрос не в том, «что умнее», а в том, во что вам обходится неправильный ответ.

  • MEDIUM — когда ошибки дёшево отловить: внутренние черновики, суммаризация, шаблонный код, правки по хорошо заданному шаблону, ответы в чате, которые человек всё равно просматривает.
  • HIGH — когда ошибки накапливаются: всё, что попадает в продакшен-код; шаги агента, выход которых идёт на вход следующему шагу; решения, которые вы не будете перепроверять.

Расчёт стоимости делает это правило ещё нагляднее. Выходные токены тарифицируются по $50/M, а чем выше effort, тем больше их сжигается на рассуждения. Сессия из 10 сложных шагов на MAX может потратить 60K токенов размышлений ($3.00) там, где HIGH потратит 15K ($0.75), — и MAX оправдан, только если без него хотя бы один из этих шагов провалился бы так, что это стоило бы вам часа работы. Полные таблицы с расчётами: цены Fable 5.1.

Эмпирическое правило: по умолчанию HIGH, для массовых вызовов с низкими ставками — MEDIUM, а отдельные трудные шаги повышайте до XHIGH/MAX прямо посреди диалога, вместо того чтобы гонять всю сессию на максимуме.

Агентные паттерны для 5.1

1. Стабильные кэшируемые префиксы — паттерн, который окупается. Чтение из кэша стоит $0.25/M против $10/M за свежий вход (то самое снижение на 75%, которое обеспечивает экономию в 5.1). Стройте агентов так, чтобы огромная стабильная часть — системный промпт, определения инструментов, стайлгайды — стояла в начале и никогда не менялась, а варьировался только хвост контекста. Сессионный паттерн Claude Code (большой стабильный системный промпт перечитывается на каждом шаге) — ровно та причина, по которой его сессии на 5.1 резко дешевеют.

2. Направляйте вызовы инструментов, а не принуждайте к ним. В Fable 5.1 убрали принудительное использование инструментовtool_choice со значением {"type": "any"} или {"type": "tool"} теперь возвращает 400. Используйте {"type": "auto"} и словами опишите, чего вы хотите:

text
Call the get_weather tool for Tokyo, then answer using only its result.
You must use the search_docs tool before answering; if it returns nothing, say so.

Благодаря адаптивным рассуждениям такое направление работает надёжнее, чем принуждение: модель может обдумать, вызывать ли инструмент и как именно, а не оказывается заперта в вызове, о котором не может рассуждать.

3. Дописывайте историю, а не переписывайте её. Редактирование предыдущих реплик посреди диалога в 5.1 ограничено (а блоки размышлений нельзя переносить между поколениями моделей). Агентные циклы должны дописывать корректирующие реплики — «этот подход не сработал из-за X, попробуй Y», — а не латать транскрипт. К тому же так получается более качественный промптинг: контекст неудачи улучшает следующую попытку.

4. Effort как дроссель агентного цикла. В мультиагентных системах запускайте планировщик и шаги со сложными рассуждениями на HIGH/XHIGH, а шаги воркеров по отдельным элементам — на MEDIUM/LOW. Тот же паттерн применим и к выбору маршрута между Fable и Astra: про оркестрацию читайте в руководстве по мультиагентным системам на GPT-6 Astra, а про то, куда и когда маршрутизировать, — в сравнении Fable 5.1 и GPT-6 Astra.

5. Переносите промпты с Fable 5? Хаки с переключателем thinking и сквозную передачу блоков размышлений придётся переделать. Чек-лист: руководство по миграции на Fable 5.1.

Примеры промптов

Извлечение данных с низкими ставками на уровне LOW:

Извлеки из этого текста номер счёта, дату и итоговую сумму. Выведи только JSON.

Сложная отладка на XHIGH:

После деплоя v2 наша задержка p99 выросла втрое, а загрузка CPU не изменилась. Вот флеймграфы и дифф. Найди наиболее вероятную причину и ранжируй три главные гипотезы, приведя по каждой аргументы за и против.

Направление инструментов при автоматическом tool choice:

Прежде чем предлагать какое-либо исправление, используй инструмент run_tests. Предлагай только такое исправление, при котором как минимум проходят ранее падавшие тесты и не ломаются остальные.

FAQ

Какие уровни effort есть в Fable 5.1?

LOW, MEDIUM, HIGH, XHIGH и MAX. По умолчанию — High в API и Claude Code, Medium на claude.ai и в Claude Cowork. Effort можно менять посреди диалога.

Нужно ли по-прежнему включать extended thinking в Fable 5.1?

Нет. Адаптивные рассуждения включены всегда — переключателя нет. Его место в качестве главного рычага, определяющего, сколько модель думает, занял уровень effort.

Что выбрать: medium или high?

По умолчанию High — для всего, где ошибки накапливаются (продакшен-код, цепочки агентов). Medium — для массовых задач, результат которых легко проверить. Проверяйте оба уровня на собственных эвалах, как рекомендует Anthropic: точка безубыточности зависит от того, во что вам обходится неправильный ответ.

Более высокий effort стоит дороже?

Да — рассуждения расходуют выходные токены, которые тарифицируются по $50/M. Сессии на MAX могут тратить на размышления в несколько раз больше, чем на HIGH. Тратьте MAX на редкие по-настоящему трудные шаги, а не на целые сессии.

Почему мои принудительные вызовы инструментов падают с ошибкой 400?

В Fable 5.1 убрали типы any и tool для tool_choice. Перейдите на {"type": "auto"} и направляйте модель инструкциями в промпте.

Как получать самые дешёвые ответы от Fable 5.1?

Сочетайте всё сразу: effort, соответствующий сложности задачи; стабильный кэшируемый префикс, чтобы повторы тарифицировались по $0.25/M; и историю, в которую только дописывают. Через шлюз вроде TeamoRouter вы сохраняете официальные цены и можете менять модель или effort в каждом запросе.

Резюме

Промптинг Fable 5.1 одной строкой: размышления включены всегда; effort — ваш регулятор; кэширование — ваша скидка. Начинайте с High, измеряйте более низкие и более высокие уровни на реальных эвалах, кэшируйте стабильный префикс, направляйте инструменты словами вместо tool_choice и дописывайте историю, а не переписывайте её. Опробуйте эти паттерны в TeamoRouter — оплата по использованию, один ключ для Fable 5.1 и всех остальных флагманов.

С чего начать

TeamoRouter — один ключ, base_url https://api.teamorouter.com/v1, Fable 5.1 с оплатой через Alipay/WeChat.

Готовы подключиться?Войдите в консоль, пополните баланс и создайте API-ключ.
Руководство по промптингу Fable 5.1: уровни effort, адаптивные рассуждения и агентные паттерны · TeamoRouter