Блог

DeepSeek V4 Pro против Claude Fable 5: бенчмарк по программированию 2026

Короткий ответ

DeepSeek V4 Pro — лучшая модель для кода 2026 года по соотношению цены и качества; Claude Fable 5 — лучшая модель для кода как таковая. На SWE-bench Verified Fable 5 набирает примерно 95% против 80.6% у V4 Pro — разрыв около 14 пунктов. Но разница в цене ошеломляет: официальная цена V4 Pro — $0.435/$0.87 за миллион токенов, а Fable 5 — $10/$50, то есть разница от 23 до 57 раз в зависимости от соотношения входа и выхода. На практике это значит следующее: примерно для 80% задач по программированию, которым не нужны рассуждения фронтирного уровня, V4 Pro даёт качество, близкое к фронтирному, по цене на уровне погрешности округления; а на самых сложных долгих агентных задачах Fable 5 по-прежнему оправдывает свою наценку. Грамотная архитектура пускает обе модели через один шлюз и отправляет каждую задачу той модели, которая соответствует её сложности.

Два соперника

DeepSeek V4 Pro

DeepSeek V4 Pro — флагман семейства DeepSeek V4. Превью вышло 24 апреля 2026 года, а GA-релиз состоялся в конце июля 2026-го. Это огромная модель с открытыми весами:

  • Архитектура: Mixture-of-Experts (MoE), 1.6 триллиона параметров всего, 49 миллиардов активных на токен
  • Контекст: контекстное окно 1M токенов, до 384K выходных токенов
  • Лицензия: MIT (открытые веса, можно разворачивать у себя)
  • Особенности: гибридное внимание (сжатое разреженное + сильно сжатое), которое при контексте в 1M токенов снижает FLOPs инференса до 27% от уровня V3.2, а потребление KV-кэша — до 10%

Claude Fable 5

Claude Fable 5 — самая мощная общедоступная модель Anthropic, выпущенная 9 июня 2026 года. Это первая публично доступная модель Anthropic «класса Mythos»:

  • Позиционирование: построена на тех же весах, что и Claude Mythos 5 (модель с ограниченным доступом для проверенных партнёров), но с включёнными защитными механизмами
  • Контекст: 1M входных токенов / 128K выходных токенов
  • Цена: ровно в 2 раза выше, чем у Claude Opus 4.8, и меньше половины цены Mythos Preview
  • Нюанс с безопасностью: когда срабатывают классификаторы безопасности Fable 5 (кибербезопасность, био/химия, дистилляция — менее чем в 5% сессий), запросы переключаются на Claude Opus 4.8

Сравнение по бенчмаркам

Это цифры 2026 года, на которые чаще всего ссылаются разработчики, оценивающие агентов для программирования.

Семейство SWE-bench (программная инженерия)

Бенчмарк DeepSeek V4 Pro Claude Fable 5
SWE-bench Verified 80.6% ~95.0%
SWE-bench Pro ~70%* 80.3%
Terminal-Bench 2.1 67.9% 84.3%

*Результат V4 Pro на SWE-bench Pro официально не публиковался; ближайшие ориентиры — его результат на Verified и сторонние оценки. Отрыв Fable 5 на SWE-bench Pro (80.3% против ~67-70%) — самый наглядный сигнал его преимущества в многошаговой инженерной работе с длинным контекстом.

Другие бенчмарки по программированию

Бенчмарк DeepSeek V4 Pro Claude Fable 5
LiveCodeBench (Pass@1) 93.5% ~90%+
Codeforces Elo 3 206 ~1 932 (GDPval-AA Elo)
HumanEval ~96.4% ~98%
FrontierCode Diamond ~13-14% 29.3%
OSWorld-Verified 85.0%

Fable 5 доминирует на самых сложных бенчмарках — FrontierCode Diamond (29.3% против ~13%) и SWE-bench Pro, — которые измеряют длительную инженерную работу с множеством файлов, а не генерацию одной функции. V4 Pro конкурентоспособен на бенчмарках формата «реши одну чётко поставленную задачу» (LiveCodeBench, Codeforces), где проявляется его чистая сила в генерации кода.

Оговорка о контаминации, которая меняет всё

Вот нюанс, на который всегда указывают серьёзные исследователи. На DeepSWE — бенчмарке без контаминации, специально устроенном так, чтобы заучивание не помогало:

Модель DeepSWE Pass@1
GPT-5.5 70%
Claude Opus 4.7 54%
DeepSeek V4 Pro ~8%

Независимые аудиты (включая широко разошедшийся анализ yage.ai) говорят о том, что V4 Pro заметно отстаёт в многошаговых агентных сценариях и на задачах без контаминации. Проще говоря: V4 Pro великолепен, когда задача похожа на его обучающие данные, и гораздо слабее в новой, долгой агентной работе — а именно под неё и создавался Fable 5. Если вы строите агентов, которым предстоит работать с по-настоящему незнакомыми кодовыми базами, придавайте этому больше веса, чем громкой цифре SWE-bench.

Цены: где V4 Pro не оставляет шансов

Это суть сравнения. По состоянию на начало августа 2026 года:

DeepSeek V4 Pro Claude Fable 5 Соотношение
Вход (за 1M токенов) $0.435 $10.00 23x
Выход (за 1M токенов) $0.87 $50.00 57x
Кэшированный вход (за 1M) $0.003625 $1.00 276x

При типичном соотношении входа к выходу 2:1 на один доллар можно получить примерно 1.15 миллиона выходных токенов от V4 Pro против 40 000 от Claude Opus 4.8 и около 33 000–40 000 от Fable 5 — разница в объёме выхода на доллар в 25-30 раз.

Пиковая и внепиковая тарификация DeepSeek

С выходом V4 DeepSeek впервые ввёл цены, зависящие от времени суток. В пиковые часы по пекинскому времени (9:00–12:00 и 14:00–18:00) ставки удваиваются: выход V4 Pro дорожает с $0.87 до $1.74, соответственно меняется и цена кэшированного входа. Внепиковые цены и цены при попадании в кэш остаются одними из самых низких в отрасли. Если у вас пакетные нагрузки, перенос их за пределы пекинских пиковых часов фактически вдвое сокращает счёт за V4 Pro.

Оговорка про «обычную цену»

V4 Pro вышел с промоценой $0.435/$0.87 — со скидкой 75%, действовавшей до 31 мая 2026 года. По обычному тарифу V4 Pro возвращается к $1.74/$3.48 — это всё ещё в 6-14 раз дешевле Fable 5, но уже не так эффектно, как выглядят промоцифры. Большинство сторонних провайдеров (включая цены, которые вы сегодня увидите в шлюзах) указывают V4 Pro по промоставке, поэтому проверяйте актуальную цену у своего провайдера и не полагайтесь ни на одну из этих цифр вслепую.

Через шлюз: множитель скидки

Когда вы работаете через шлюз, скидки поставщика меняют картину ещё сильнее. По состоянию на август 2026 года:

Модель Официальная цена (вход/выход) Ставка TeamoRouter Итог
DeepSeek V4 Pro $0.435 / $0.87 Официальная цена (без наценки) $0.435 / $0.87
Claude Fable 5 $10 / $50 Множитель 0.18x ~$1.80 / $9.00

Главный вывод: плавающая скидка TeamoRouter распространяется на Claude Fable 5, и его фактическая цена падает с $10/$50 примерно до $1.80/$9.00. Исходный разрыв в 23-57 раз сужается примерно до 4-10 раз. Fable 5 через шлюз со скидкой — уже не абсурдная роскошь, а вполне реальный кандидат для сложных задач даже при скромном бюджете.

Стоимость одной задачи: реальная арифметика

Сами по себе бенчмарки не показывают, каким будет ваш счёт. Смоделируем реалистичную агентную задачу по программированию: рефакторинг нескольких файлов, который потребляет 50K входных и 5K выходных токенов за итерацию, всего 100 итераций.

V4 Pro (официально) V4 Pro (вне пика) Fable 5 (официально) Fable 5 (через шлюз 0.18x)
За итерацию (50K вход + 5K выход) ~$0.026 ~$0.013 ~$0.75 ~$0.14
100 итераций ~$2.60 ~$1.30 ~$75.00 ~$13.50
При 90% попаданий в кэш ~$0.55 ~$27.00 ~$5.00

Даже с учётом того, что Fable 5 тратит на задачу на 25-30% меньше ходов (он справляется за меньшее число итераций), чистое ценовое преимущество V4 Pro огромно. В масштабе — скажем, 10 000 задач в день — V4 Pro обходится в сотни долларов в день, а Fable 5 по официальным ценам — в десятки тысяч. Через шлюз со скидкой Fable 5 превращается из открытого на полную крана в контролируемую премиальную статью расходов.

Когда направлять задачу в V4 Pro

Выбирайте DeepSeek V4 Pro, когда:

  • Задача чётко сформулирована и решается за один проход. Генерация кода по ясному промпту, написание функций, генерация тестов, задачи в стиле LeetCode, шаблонный код.
  • Нужен контекст в 1M токенов при ограниченном бюджете. Контекст 1M у V4 Pro при цене кэшированного входа $0.003625 позволяет анализировать огромные репозитории за копейки.
  • Вы хотите разворачивать модель у себя. Лицензия MIT позволяет запускать V4 Pro на собственном железе — это единственный вариант в нашем сравнении, который такое допускает.
  • Вас ограничивает объём. Генерация тестов в CI, код-ревью тысяч PR, пакетная документация — всё, где определяющей становится стоимость одной задачи.

Когда направлять задачу в Claude Fable 5

Выбирайте Claude Fable 5, когда:

  • Задача долгая и многошаговая. Архитектурный рефакторинг, миграции, затрагивающие много файлов, отладка по-настоящему незнакомого кода, «спланируй и выполни двухчасовую инженерную задачу».
  • Важна свобода от контаминации. На новых кодовых базах (DeepSWE) Fable 5 играет в другой лиге.
  • Задачи в духе FrontierCode. Задачи уровня Diamond, где вам нужна максимальная доля решённых ~29%, а не ~13%, которые дают остальные.
  • Вам важно меньшее число ходов. Fable 5 завершает работу за 25-30% меньше итераций, а это существенно для агентных циклов, где задержка накапливается.

Стратегия маршрутизации: лучшее от обеих моделей

Выигрышная архитектура 2026 года — не «выбрать одну модель», а маршрутизация по сложности задачи. Отправляйте простые 80% в V4 Pro (или в ещё более дешёвый V4 Flash), а Fable 5 приберегите для сложных 20%. Именно под такой сценарий и создан шлюз вроде TeamoRouter: один API-ключ, выбор модели на уровне запроса и плавающие скидки, которые делают премиальную модель доступной.

python
from openai import OpenAI

client = OpenAI(
    api_key="sk-teamo-xxxxxx",
    base_url="https://api.teamorouter.com/v1",
)

def pick_model(difficulty: str) -> str:
    # Простые задачи: DeepSeek V4 Pro (или V4 Flash)
    # Сложные задачи: Claude Fable 5
    return "deepseek-v4-pro" if difficulty == "easy" else "claude-fable-5"

resp = client.chat.completions.create(
    model=pick_model("easy"),
    messages=[
        {"role": "user", "content": "Write a unit test for this parser function."}
    ],
)
print(resp.choices[0].message.content)

Можно даже использовать SDK от Anthropic с Anthropic-совместимым эндпоинтом TeamoRouter для моделей Claude, а OpenAI-совместимый эндпоинт — для моделей DeepSeek, и всё это в рамках одного аккаунта:

bash
export ANTHROPIC_BASE_URL="https://api.teamorouter.com/anthropic"
export ANTHROPIC_API_KEY="sk-teamo-xxxxxx"

export OPENAI_BASE_URL="https://api.teamorouter.com/v1"
export OPENAI_API_KEY="sk-teamo-xxxxxx"

FAQ

Какая модель лучше программирует: V4 Pro или Fable 5?

Fable 5 программирует лучше на самых сложных бенчмарках — SWE-bench Verified (~95% против 80.6%), SWE-bench Pro (80.3%) и FrontierCode Diamond (29.3%). V4 Pro выгоднее: он стоит в 23-57 раз дешевле за токен и отстаёт на SWE-bench Verified всего на ~8-14 пунктов, поэтому подходит для большинства задач по программированию.

DeepSeek V4 Pro правда в 57 раз дешевле Claude Fable 5?

По официальным ценам — да, для выходных токенов: $0.87 против $50 за миллион. Разрыв сокращается, если учесть обычную (не промо) цену DeepSeek $1.74/$3.48, и сокращается резко, если Claude идёт через шлюз со скидкой вроде TeamoRouter (Fable 5 опускается до ~$1.80/$9.00).

Можно ли использовать V4 Pro и Fable 5 с одним API-ключом?

Да. Шлюз вроде TeamoRouter даёт доступ к обеим моделям из одного аккаунта — через OpenAI-совместимый и Anthropic-совместимый эндпоинты. Модель вы выбираете в каждом запросе.

DeepSeek V4 Pro — это open source?

Да. V4 Pro выпущен под лицензией MIT с открытыми весами, они доступны на Hugging Face. Среди моделей для кода высшего эшелона это уникальный случай, и он позволяет разворачивать модель у себя.

Влияет ли защитное переключение Fable 5 на качество кода?

Fable 5 переключается на Claude Opus 4.8, когда срабатывают его классификаторы безопасности (менее чем в 5% сессий). В большинстве задач по программированию этого не происходит никогда; а в задачах, смежных с кибербезопасностью или био/химией, переключение означает, что вы фактически получаете результат уровня Opus 4.8, а не уровня Mythos 5. Это важно для инструментов безопасности, но не играет роли в обычной программной инженерии.

Какую модель взять для повседневного агента?

Ради экономии используйте по умолчанию V4 Pro (или V4 Flash), а на сложных многошаговых задачах переключайтесь на Fable 5. Если вы строите агента, который должен надёжно справляться с незнакомой долгой работой, и бюджет позволяет, Fable 5 через шлюз со скидкой — самый безопасный выбор, если модель нужна одна.

Итог

DeepSeek V4 Pro задаёт новую планку соотношения цены и качества; Claude Fable 5 остаётся королём надёжности на самых сложных задачах. Рецепт 2026 года — не верность одному поставщику, а стратегия маршрутизации, которая отправляет каждую задачу туда, где она стоит дешевле всего и решается лучше всего. Один API-ключ, обе модели, маршрутизация на уровне запроса — для этого шлюз и нужен.

С чего начать

Пустите обе модели через TeamoRouter, и пусть каждая задача сама выбирает свой ценовой уровень:

  1. Зарегистрируйтесь в TeamoRouter
  2. Пополните баланс через Alipay, WeChat Pay или картой
  3. Вызывайте deepseek-v4-pro и claude-fable-5 с одним API-ключом по адресу https://api.teamorouter.com/v1

Начать маршрутизацию DeepSeek + Claude →

DeepSeek — для простых 80%, Claude Fable 5 — для сложных 20%: один ключ, плавающие скидки, никаких переплат.

Готовы подключиться?Войдите в консоль, пополните баланс и создайте API-ключ.
DeepSeek V4 Pro против Claude Fable 5: бенчмарк по программированию 2026 · TeamoRouter