Краткий ответ
DeepSeek V4 Pro — «планировщик» в семействе V4: разреженная MoE-архитектура примерно на 685B параметров, лицензия MIT и контекстное окно в 1M токенов. Текущая акционная цена — $0.435 за миллион входных и $0.87 за миллион выходных токенов; после окончания акции обычная цена составит $1.74/$3.48. Это экономичный архитектор для многофайловых рефакторингов и проектирования систем, который лучше всего работает в паре с V4 Flash в роли исполнителя. Вместе они образуют самый выгодный двухуровневый стек для программирования в 2026 году: V4 Pro планирует работу, V4 Flash выполняет её втрое дешевле. В этой статье собраны последние новости о V4 Pro — цены, возможности, бенчмарки, инструменты и сравнение с GPT-5.6 Sol и Claude Opus 4.8. Получить доступ к V4 Pro можно через TeamoRouter — наряду с Claude, GPT, Gemini и Kimi, с одним ключом.
V4 Pro и V4 Flash: планировщик и исполнитель
DeepSeek позиционирует две модели V4 с чётким разделением труда:
| Роль | Модель | Цена (вход/выход за млн) | В чём сильна |
|---|---|---|---|
| Планировщик | V4 Pro | $0.435/$0.87 (акция) | Архитектура, многофайловые рефакторинги, сложные рассуждения |
| Исполнитель | V4 Flash | $0.14/$0.28 | Генерация кода, написание тестов, агентные циклы |
У V4 Pro существенно больший пул экспертов, и на каждый токен она тратит больше вычислений. В рассуждениях над несколькими файлами и в проектировании систем она заметно сильнее Flash. Рекомендуемый гибридный процесс:
V4 Pro → планирование архитектуры, ревью дизайна (~20% токенов)
V4 Flash → генерация файлов, написание тестов, исправление lint-ошибок (~70% токенов)
V4 Pro → финальное ревью (~10% токенов)
Такой гибрид сокращает расходы на API примерно на 64% по сравнению с использованием V4 Pro везде — при почти идентичном качестве результата на уровне исполнения.
Текущие цены: акционное окно
| Тариф | Вход (за млн) | Выход (за млн) |
|---|---|---|
| Акционный (действует сейчас) | $0.435 | $0.87 |
| Обычный (после акции) | $1.74 | $3.48 |
Дата окончания акции не объявлена. Но даже по обычной цене V4 Pro дешевле любой сопоставимой модели:
| Модель | Вход | Выход | Во сколько раз дороже V4 Pro (обычная цена) |
|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | 2.9x / 8.6x |
| Claude Opus 4.8 | $5.00 | $25.00 | 2.9x / 7.2x |
| Claude Sonnet 4.6 | $3.00 | $15.00 | 1.7x / 4.3x |
| V4 Pro (обычная цена) | $1.74 | $3.48 | — |
Политика пиковых часов
DeepSeek объявила, что в пиковые часы по пекинскому времени (9:00-12:00, 14:00-18:00 CST) цены вырастут до 2x от базовой ставки. По состоянию на начало августа 2026 года это правило ещё не вступило в силу, но когда вступит, командам стоит планировать пакетные нагрузки вне пиковых часов или настроить автоматическое переключение на V4 Flash.
Доступ через API
V4 Pro полностью совместима с OpenAI. Подойдёт любой клиент OpenAI — достаточно поменять base_url.
from openai import OpenAI
client = OpenAI(
api_key="sk-your-deepseek-key",
base_url="https://api.deepseek.com",
)
response = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[
{"role": "user", "content": "Design a rate-limiting middleware supporting sliding window, token bucket, and fixed window strategies."},
],
max_tokens=4096,
)
Через TeamoRouter
Один ключ, один эндпоинт — и доступ к V4 Pro вместе со всеми остальными крупными моделями:
from openai import OpenAI
client = OpenAI(
api_key="tr-your-key-here",
base_url="https://api.teamorouter.com/v1",
)
response = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[
{"role": "user", "content": "Architect a multi-tenant database schema with isolation levels, indexing strategy, and migration paths."},
],
)
curl https://api.teamorouter.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer tr-your-key-here" \
-d '{
"model": "deepseek-v4-pro",
"messages": [{"role": "user", "content": "Explain trade-offs between microservices and modular monolith for an early-stage startup."}],
"max_tokens": 2048
}'
Обновления возможностей
Responses API (ожидается в начале августа 2026 года)
На момент запуска 31 июля V4 Flash была единственной моделью DeepSeek с поддержкой Responses API. Поддержку в V4 Pro ожидали в начале августа 2026 года — после этого модель станет доступна агентным фреймворкам через вызов client.responses.create().
Эндпоинт, совместимый с Anthropic
V4 Pro доступна также по адресу https://api.deepseek.com/anthropic, так что её можно использовать в Claude Code, Cline и других инструментах, ориентированных на Anthropic, — как более дешёвую вторую модель для планирования.
Управление режимом размышлений
V4 Pro поддерживает параметры thinking и reasoning_effort. Когда режим размышлений включён, temperature и top_p игнорируются. Для задач планирования оставляйте размышления включёнными — глубина рассуждений и есть то, за что вы платите.
Позиции в бенчмарках
| Бенчмарк | V4 Pro (заявлено) | Что измеряет |
|---|---|---|
| SWE-bench Verified | 80.6 | Решение реальных issue с GitHub |
| DSBench-FullStack | выше Flash (68.7) | Full-stack-разработка |
| Общий агентный балл | ~25+ (оценка) | Сводные агентные способности |
Главная цифра — 80.6 на SWE-bench Verified: она ставит V4 Pro в высший эшелон моделей для кода, впереди большинства конкурентов именно на этом бенчмарке.
V4 Pro против флагманских моделей
V4 Pro и Claude Opus 4.8
| Параметр | V4 Pro | Opus 4.8 |
|---|---|---|
| Цена выхода | $0.87–$3.48 | $25.00 |
| Контекст | 1M токенов | 200K+ |
| Зрение | Нет | Да |
| Качество архитектурных решений | Высокое | Очень высокое |
| Лицензия | MIT | Проприетарная |
По выходным токенам V4 Pro обходится примерно в 7-29 раз дешевле Opus. В чисто текстовых архитектурных задачах она близка по качеству. Главный пробел — зрение: если в планировании участвуют скриншоты или диаграммы, без Opus (или Sol) не обойтись.
V4 Pro и GPT-5.6 Sol
Sol в целом сильнее (TerminalBench 88.8 std / 91.9 Ultra), но стоит $30/M за выход против $0.87 (акция) у V4 Pro — разница в 34 раза. В текстовом планировании V4 Pro даёт большую часть качества рассуждений Sol за малую долю цены.
Стек 2026 года
Планирование/архитектура → DeepSeek V4 Pro (глубина при разумной цене)
Генерация кода/тесты → DeepSeek V4 Flash (дёшево, быстро, большие объёмы)
Задачи с изображениями → GPT-5.6 Sol или Claude (только при необходимости)
Ситуация с доступом в Китае
Разработчикам в Китае модели DeepSeek доступны напрямую, без VPN: api.deepseek.com работает из коробки. Для доступа к Claude и GPT обычно нужны и VPN, и международная банковская карта. TeamoRouter решает эту проблему, объединяя DeepSeek, Claude, GPT, Gemini и Kimi за одним эндпоинтом с поддержкой Alipay и WeChat Pay, — оба барьера исчезают для команд, которые хотят сочетать китайские и международные модели. V4 Pro доступна напрямую у DeepSeek, через TeamoRouter и через различные сторонние шлюзы.
Экосистема инструментов
Агентная маршрутизация TeamoRouter
Для автоматического выбора модели в мультимодельном стеке:
rules:
- name: architecture-planning
match: task_type in ["plan", "design"] or complexity == "high"
model: deepseek-v4-pro
- name: code-execution
match: task_type in ["code_edit", "test_write"]
model: deepseek-v4-flash
- name: vision-tasks
match: has_image == true
model: claude-opus-4-8
- name: fallback
match: "*"
model: deepseek-v4-flash
Один ключ, одна консоль, автоматическая маршрутизация и оплата через Alipay, WeChat или международную карту.
Codex, Cline и Claude Code
У V4 Pro есть официальная интеграция с Codex. Cline и Claude Code могут работать с ней через эндпоинт, совместимый с Anthropic, или через TeamoRouter. Многие команды используют V4 Pro в Claude Code как вторую модель для планирования: Claude — для интерактивных сессий, V4 Pro — для пакетного планирования с меньшими затратами.
Миграция с устаревших ID
24 июля 2026 года DeepSeek объявила устаревшими deepseek-chat и deepseek-reasoner:
| Устаревший ID | Замена |
|---|---|
deepseek-chat |
deepseek-v4-flash или deepseek-v4-pro |
deepseek-reasoner |
deepseek-v4-flash (с включённым режимом размышлений) |
Итог
DeepSeek V4 Pro по акционной цене $0.435/$0.87 — самая экономичная модель архитектурного уровня для программирования в 2026 году. В текстовом планировании она конкурирует с Claude Opus 4.8 и GPT-5.6 Sol, обходясь в 7-34 раза дешевле. Добавьте к ней V4 Flash для исполнения, держите наготове модель со зрением для тех 5-10% задач, где нужны изображения, — и вы получите мультимодельную конфигурацию промышленного уровня за малую долю стоимости стека из одних флагманов. TeamoRouter объединяет все эти модели под одним ключом — с автоматической маршрутизацией и поддержкой китайских платёжных систем.
Попробуйте DeepSeek V4 Pro в TeamoRouter — один ключ, 50+ моделей, поддержка Alipay и WeChat.
FAQ
Сколько сейчас стоит DeepSeek V4 Pro?
По акции: $0.435/M за вход, $0.87/M за выход. Обычная цена: $1.74/$3.48. Входные токены при попадании в кэш стоят значительно дешевле.
Чем V4 Pro отличается от V4 Flash?
V4 Pro — более сильный планировщик для многофайловых рефакторингов и архитектуры. V4 Flash — более дешёвый и быстрый исполнитель. Идеальная схема: Pro на ~20-30% токенов (планирование и ревью), Flash — на всё остальное.
Поддерживает ли V4 Pro зрение?
Нет. И V4 Pro, и V4 Flash работают только с текстом. Для изображений на входе используйте GPT-5.6 Sol или Claude.
V4 Pro — это open source?
Веса распространяются по лицензии MIT и допускают коммерческое использование. Основной канал распространения — облачный API самой DeepSeek.
Есть ли у V4 Pro поддержка Responses API?
Ожидается в начале августа 2026 года. На момент запуска V4 Flash 31 июля Flash была единственной моделью DeepSeek с нативным Responses API.
Какое у неё контекстное окно?
1M токенов — достаточно, чтобы обработать целый репозиторий среднего размера за один вызов.
Можно ли использовать V4 Pro с Claude Code или Cline?
Да — через эндпоинт, совместимый с Anthropic, или через TeamoRouter.
Как V4 Pro смотрится на фоне Claude Opus 4.8?
В текстовых архитектурных задачах V4 Pro близка к Opus по качеству при цене в 7-29 раз ниже. Opus сильнее в зрении и зрелости экосистемы.
Когда начнут действовать цены пиковых часов?
Они объявлены, но по состоянию на начало августа 2026 года ещё не действуют. Когда вступят в силу, планируйте пакетные нагрузки вне пиковых часов по пекинскому времени.