Короткий ответ
С выходом Fable 5.1 промптинг изменился: адаптивные рассуждения включены всегда, так что переключателя extended thinking больше нет. Ваш главный рычаг управления теперь — уровень effort: LOW, MEDIUM, HIGH, XHIGH или MAX. Официальная рекомендация Anthropic: начинайте со значения по умолчанию (High) и проверяйте более низкие и более высокие уровни на собственных эвалах, а не гадайте. Всё остальное — чёткие инструкции, стабильные кэшируемые префиксы, направляющие указания вместо принудительного вызова инструментов — важно не меньше, чем в Fable 5, а теперь окупается вдвойне благодаря чтению из кэша по $0.25/M.
Пять уровней effort
| Effort | Глубина рассуждений | Стоимость / задержка | Где по умолчанию | Для чего подходит |
|---|---|---|---|---|
| LOW | Минимум размышлений | Дешевле и быстрее всего | — | Извлечение данных, форматирование, простые переписывания |
| MEDIUM | Умеренная | Низкие | claude.ai, Claude Cowork | Рутинные вопросы и ответы, короткие правки кода |
| HIGH | Полные адаптивные рассуждения | Умеренные | API, Claude Code | Вариант по умолчанию для большинства задач разработки |
| XHIGH | Расширенная | Высокие | — | Сложная отладка, архитектура, многошаговая математика |
| MAX | Максимальный бюджет | Наивысшие | — | Задачи исследовательского уровня, где оправданы и минуты, и доллары |
Значения по умолчанию говорят сами за себя: Anthropic выбрала High для API и Claude Code (работа, за которую вы платите по токенам) и Medium для claude.ai и Claude Cowork (интерактивный чат, где важна скорость). Effort можно менять прямо посреди диалога — поднимайте его, когда шаг становится трудным, и снижайте, когда план уже определён.
Официальная рекомендация: начинайте с High, затем измеряйте
Документация Anthropic по промптингу Fable 5.1 на редкость прямолинейна: effort — главный рычаг, по умолчанию ставьте High и проверяйте low/medium/xhigh/max на собственных эвалах. Не по ощущениям, а на наборе задач, где корректность можно оценить. Причина вот в чём: при адаптивных рассуждениях модель сама решает, сколько думать в пределах уровня effort, так что рычаг, который вы поворачиваете, — это потолок бюджета, а правильный потолок зависит от конкретной нагрузки.
Практический цикл:
- Соберите эвал из 20–50 кейсов под вашу задачу (подойдёт даже таблица с отметками «прошёл/не прошёл»).
- Прогоните его на HIGH — это базовая линия.
- Попробуйте MEDIUM и XHIGH. Если MEDIUM даёт тот же результат при ощутимо меньшей стоимости — используйте его. Если XHIGH исправляет реальные провалы — оставьте его для этих классов ошибок.
- Возвращайтесь к этому раз в квартал: обновления модели сдвигают оптимум.
Medium или High: правило выбора
Вопрос не в том, «что умнее», а в том, во что вам обходится неправильный ответ.
- MEDIUM — когда ошибки дёшево отловить: внутренние черновики, суммаризация, шаблонный код, правки по хорошо заданному шаблону, ответы в чате, которые человек всё равно просматривает.
- HIGH — когда ошибки накапливаются: всё, что попадает в продакшен-код; шаги агента, выход которых идёт на вход следующему шагу; решения, которые вы не будете перепроверять.
Расчёт стоимости делает это правило ещё нагляднее. Выходные токены тарифицируются по $50/M, а чем выше effort, тем больше их сжигается на рассуждения. Сессия из 10 сложных шагов на MAX может потратить 60K токенов размышлений ($3.00) там, где HIGH потратит 15K ($0.75), — и MAX оправдан, только если без него хотя бы один из этих шагов провалился бы так, что это стоило бы вам часа работы. Полные таблицы с расчётами: цены Fable 5.1.
Эмпирическое правило: по умолчанию HIGH, для массовых вызовов с низкими ставками — MEDIUM, а отдельные трудные шаги повышайте до XHIGH/MAX прямо посреди диалога, вместо того чтобы гонять всю сессию на максимуме.
Агентные паттерны для 5.1
1. Стабильные кэшируемые префиксы — паттерн, который окупается. Чтение из кэша стоит $0.25/M против $10/M за свежий вход (то самое снижение на 75%, которое обеспечивает экономию в 5.1). Стройте агентов так, чтобы огромная стабильная часть — системный промпт, определения инструментов, стайлгайды — стояла в начале и никогда не менялась, а варьировался только хвост контекста. Сессионный паттерн Claude Code (большой стабильный системный промпт перечитывается на каждом шаге) — ровно та причина, по которой его сессии на 5.1 резко дешевеют.
2. Направляйте вызовы инструментов, а не принуждайте к ним. В Fable 5.1 убрали принудительное использование инструментов — tool_choice со значением {"type": "any"} или {"type": "tool"} теперь возвращает 400. Используйте {"type": "auto"} и словами опишите, чего вы хотите:
Call the get_weather tool for Tokyo, then answer using only its result.
You must use the search_docs tool before answering; if it returns nothing, say so.
Благодаря адаптивным рассуждениям такое направление работает надёжнее, чем принуждение: модель может обдумать, вызывать ли инструмент и как именно, а не оказывается заперта в вызове, о котором не может рассуждать.
3. Дописывайте историю, а не переписывайте её. Редактирование предыдущих реплик посреди диалога в 5.1 ограничено (а блоки размышлений нельзя переносить между поколениями моделей). Агентные циклы должны дописывать корректирующие реплики — «этот подход не сработал из-за X, попробуй Y», — а не латать транскрипт. К тому же так получается более качественный промптинг: контекст неудачи улучшает следующую попытку.
4. Effort как дроссель агентного цикла. В мультиагентных системах запускайте планировщик и шаги со сложными рассуждениями на HIGH/XHIGH, а шаги воркеров по отдельным элементам — на MEDIUM/LOW. Тот же паттерн применим и к выбору маршрута между Fable и Astra: про оркестрацию читайте в руководстве по мультиагентным системам на GPT-6 Astra, а про то, куда и когда маршрутизировать, — в сравнении Fable 5.1 и GPT-6 Astra.
5. Переносите промпты с Fable 5? Хаки с переключателем thinking и сквозную передачу блоков размышлений придётся переделать. Чек-лист: руководство по миграции на Fable 5.1.
Примеры промптов
Извлечение данных с низкими ставками на уровне LOW:
Извлеки из этого текста номер счёта, дату и итоговую сумму. Выведи только JSON.
Сложная отладка на XHIGH:
После деплоя v2 наша задержка p99 выросла втрое, а загрузка CPU не изменилась. Вот флеймграфы и дифф. Найди наиболее вероятную причину и ранжируй три главные гипотезы, приведя по каждой аргументы за и против.
Направление инструментов при автоматическом tool choice:
Прежде чем предлагать какое-либо исправление, используй инструмент run_tests. Предлагай только такое исправление, при котором как минимум проходят ранее падавшие тесты и не ломаются остальные.
FAQ
Какие уровни effort есть в Fable 5.1?
LOW, MEDIUM, HIGH, XHIGH и MAX. По умолчанию — High в API и Claude Code, Medium на claude.ai и в Claude Cowork. Effort можно менять посреди диалога.
Нужно ли по-прежнему включать extended thinking в Fable 5.1?
Нет. Адаптивные рассуждения включены всегда — переключателя нет. Его место в качестве главного рычага, определяющего, сколько модель думает, занял уровень effort.
Что выбрать: medium или high?
По умолчанию High — для всего, где ошибки накапливаются (продакшен-код, цепочки агентов). Medium — для массовых задач, результат которых легко проверить. Проверяйте оба уровня на собственных эвалах, как рекомендует Anthropic: точка безубыточности зависит от того, во что вам обходится неправильный ответ.
Более высокий effort стоит дороже?
Да — рассуждения расходуют выходные токены, которые тарифицируются по $50/M. Сессии на MAX могут тратить на размышления в несколько раз больше, чем на HIGH. Тратьте MAX на редкие по-настоящему трудные шаги, а не на целые сессии.
Почему мои принудительные вызовы инструментов падают с ошибкой 400?
В Fable 5.1 убрали типы any и tool для tool_choice. Перейдите на {"type": "auto"} и направляйте модель инструкциями в промпте.
Как получать самые дешёвые ответы от Fable 5.1?
Сочетайте всё сразу: effort, соответствующий сложности задачи; стабильный кэшируемый префикс, чтобы повторы тарифицировались по $0.25/M; и историю, в которую только дописывают. Через шлюз вроде TeamoRouter вы сохраняете официальные цены и можете менять модель или effort в каждом запросе.
Резюме
Промптинг Fable 5.1 одной строкой: размышления включены всегда; effort — ваш регулятор; кэширование — ваша скидка. Начинайте с High, измеряйте более низкие и более высокие уровни на реальных эвалах, кэшируйте стабильный префикс, направляйте инструменты словами вместо tool_choice и дописывайте историю, а не переписывайте её. Опробуйте эти паттерны в TeamoRouter — оплата по использованию, один ключ для Fable 5.1 и всех остальных флагманов.
С чего начать
TeamoRouter — один ключ, base_url https://api.teamorouter.com/v1, Fable 5.1 с оплатой через Alipay/WeChat.