Блог

Codex Fast mode: всё, что нужно знать разработчику в 2026 году

Короткий ответ

Codex Fast mode — это скоростной уровень обслуживания для Codex CLI, десктопного приложения и расширения для IDE: вы платите больше кредитов и получаете меньшую задержку. Режим ускоряет ответы поддерживаемых моделей GPT примерно в 1.5x, но расходует в 2x-2.5x больше кредитов, чем режим Standard. Включается он встроенной командой /fast, закрепляется в ~/.codex/config.toml строкой service_tier = "fast" и работает только с GPT-5.6, GPT-5.5 и GPT-5.4. По сути Fast mode — это воплощение на кредитах ChatGPT того же механизма service_tier, который в API OpenAI называется «Fast mode» (раньше — «Priority processing»). Именно его маршрутизатор вроде TeamoRouter может прозрачно пробрасывать с помощью одной строки в конфиге.

Что такое Codex Fast mode?

Codex — это ИИ-агент для кода от OpenAI, который работает в терминале, в десктопном приложении и внутри IDE. Когда вы запускаете задачу, модель генерирует токены, и скорость этой генерации — в токенах в секунду — напрямую определяет, как долго вы смотрите на мигающий курсор.

Fast mode — это уровень обслуживания (service tier), а не другая модель. Вы не переключаетесь на модель поменьше или послабее: интеллект остаётся тем же, а бэкенд просто ставит ваш запрос в очередь с более высоким приоритетом. В результате токены генерируются быстрее и стабильнее. Ответы модели не становятся ни «умнее», ни «глупее» — они просто приходят быстрее.

На август 2026 года поддерживаются три модели:

Модель Скорость в Standard Скорость в Fast mode Множитель кредитов
GPT-5.6 Базовая ~1.5x 2.5x
GPT-5.5 Базовая ~1.5x 2.5x
GPT-5.4 Базовая ~1.5x 2x

Множитель важен: GPT-5.6 и GPT-5.5 в Fast mode сжигают 2.5x кредитов, а GPT-5.4 — более щадящие 2x. Если модель не поддерживает Fast mode, CLI просто не передаёт уровень и возвращается к Standard — без падений и без скрытых доплат.

Fast mode, Codex-Spark и API Priority: не путайте

В экосистеме Codex 2026 года есть три связанных, но разных понятия, которые постоянно смешивают:

  1. Codex Fast mode (кредиты ChatGPT) — переключатель /fast, которым вы пользуетесь, войдя через ChatGPT. Ускоряет GPT-5.6/5.5/5.4 при расходе кредитов в 2-2.5x. Именно о нём эта статья.

  2. Codex-Spark — отдельная быстрая, но менее способная модель Codex, оптимизированная для почти мгновенных итераций и доступная подписчикам Pro. Это самостоятельный выбор модели со своими лимитами использования, а не скоростной уровень поверх GPT-5.6.

  3. API Fast / Priority processing (оплата по токенам) — когда вы вызываете API OpenAI (или совместимый с OpenAI шлюз) с service_tier: "fast" (устаревшее значение — "priority"), вы платите за токены по двойному стандартному тарифу. Пользователи с API-ключом получают цены за токены, а не за кредиты ChatGPT. 30 июля 2026 года OpenAI переименовала «Priority processing» в «Fast mode» во всём API, так что старое значение priority по-прежнему работает и ведёт себя точно так же.

Если вы используете Codex с API-ключом, а не с подпиской ChatGPT, команда /fast и множитель кредитов работают иначе: вы платите по токенам, а скоростным уровнем управляет service_tier. Именно это различие чаще всего вызывает путаницу, так что запомните его, прежде чем переключать флаги.

Как включить Fast mode

Слэш-команда /fast

В Codex CLI (а также в десктопном приложении и расширении для IDE, если вы вошли через ChatGPT) Fast mode — это переключатель на уровне сессии:

bash
# В интерактивной сессии Codex:
/fast

Введите команду один раз, чтобы включить режим, и ещё раз — чтобы выключить. Отдельного синтаксиса on/off в текущей стабильной версии CLI нет: /fast — обычный переключатель. Некоторые сборки от сообщества и обёртки предлагают /fast on, /fast off и /fast status, но официальный клиент не усложняет.

Постоянная настройка в config.toml

Если вы хотите, чтобы каждый запрос в проекте шёл в Fast mode и не нужно было вводить /fast в каждой сессии, добавьте строку service_tier в конфиг Codex:

toml
# ~/.codex/config.toml
model = "gpt-5.6"
service_tier = "fast"

[features]
fast_mode = true

Именно ключ service_tier = "fast" направляет запрос на быстрый уровень. Флаг [features].fast_mode = true включает саму возможность; по умолчанию она стабильна. Если у модели нет уровня Fast, CLI молча опускает этот параметр — это безопасный откат, а не ошибка.

Как убедиться, что режим активен

Выполните /fast и отправьте промпт. В подробном (verbose) режиме можно посмотреть тело запроса: Fast mode передаёт значение service_tier: "priority" (устаревшее имя на уровне протокола, которое бэкенд по-прежнему принимает), а Standard не передаёт никакого переопределения. Если уровень виден в теле запроса, Fast mode включён.

Сколько это стоит на самом деле

Цены Fast mode — то, что чаще всего удивляет разработчиков, поэтому будем точны.

В кредитах ChatGPT

Модель Кредитов за запрос (Standard) Кредитов за запрос (Fast) Соотношение
GPT-5.6 1x 2.5x 2.5x
GPT-5.5 1x 2.5x 2.5x
GPT-5.4 1x 2x 2x

«Кредиты» — это единица расхода в подписках ChatGPT (Pro, Plus и т. д.). Множитель 2.5x означает, что задача, которая в Standard израсходовала бы 1 000 кредитов, в Fast mode израсходует 2 500. В тяжёлых агентных сессиях на сотни ходов это быстро накапливается — именно поэтому официальная рекомендация такова: приберегите Fast mode для интерактивной работы, чувствительной к задержкам.

В токенах API (OpenAI или шлюз)

Когда вы используете API вместо кредитов ChatGPT, Fast mode оплачивается по токенам — по двойной официальной цене режима Standard. Для GPT-5.6 Sol:

Standard Fast mode
Ввод $5.00 / 1M токенов $10.00 / 1M токенов
Кэшированный ввод $0.50 / 1M токенов $1.00 / 1M токенов
Вывод $30.00 / 1M токенов $60.00 / 1M токенов

Это та же структура цен, которую API OpenAI называет «Fast mode» и которую TeamoRouter прозрачно пробрасывает.

При чём тут TeamoRouter: ваша скидка сохраняется

Вот что важно для всех, кто работает через шлюз: когда вы направляете Codex через TeamoRouter, Fast mode тарифицируется по двойной официальной цене, и скидка вашего аккаунта по-прежнему применяется поверх неё. Из документации TeamoRouter по биллингу:

В режиме Fast mode официальная цена модели вдвое выше цены стандартного режима, а действующая скидка вашего аккаунта остаётся без изменений.

Конкретный пример: если официальная цена вывода стандартного gpt-5.6-sol — $30 и у вашего аккаунта есть скидка, то в Fast mode официальная цена становится $60, и та же скидка применяется к этим $60, а не к стандартной цене со скидкой. В интерфейсе биллинга запросы в Fast mode помечаются подсказкой «Fast», так что их легко найти в истории операций.

Когда стоит использовать Fast mode?

Используйте

  • В интерактивной работе с кодом, чувствительной к задержкам. Больше всего выигрывают парное программирование вживую, отладка, когда вы ждёте ответа, и исследование в стиле REPL. Ускорение в 1.5x, которое экономит несколько секунд на каждом ходе, за длинную сессию складывается в ощутимое время.
  • Для шагов агента, которые держат ваше внимание. Когда Codex вносит правки последовательно, а вы читаете каждый diff, меньшее время до первого токена помогает не выпадать из потока.
  • На демо и в парных сессиях. Когда кто-то смотрит на экран, быстрые ответы выглядят намного лучше, даже если общее число токенов то же.

Не используйте

  • Для пакетных задач и фоновых агентов. Если вы запустили рефакторинг и ушли, наценка в 2-2.5x кредитов ничего вам не даёт.
  • Для запросов с длинным контекстом. В ряде конфигураций Fast mode не распространяется на нагрузки с длинным контекстом; CLI откатывается к Standard, а не выдаёт ошибку.
  • Если бюджет аккаунта ограничен. При 2.5x для GPT-5.6 интенсивная сессия в Fast mode на весь день может съесть баланс кредитов за считаные часы. Standard не зря стоит по умолчанию.

Разумная политика по умолчанию: оставьте Standard глобальным значением в config.toml, а /fast включайте только для конкретных интерактивных задач, где узкое место — задержка.

Fast mode через TeamoRouter: настройка

Если вы запускаете Codex через TeamoRouter (а это оплата через Alipay/WeChat Pay, один API-ключ для моделей OpenAI/Anthropic/Gemini и прямое подключение из сетей с ограничениями), включить Fast mode — дело двух минут.

Сначала направьте Codex на TeamoRouter:

bash
export OPENAI_BASE_URL="https://api.teamorouter.com/v1"
export OPENAI_API_KEY="sk-teamo-xxxxxx"

Затем включите Fast mode внутри сессии Codex:

bash
/fast

Или закрепите его в ~/.codex/config.toml:

toml
model = "gpt-5.6"
base_url = "https://api.teamorouter.com/v1"
service_tier = "fast"

Со стороны шлюза можно также передать service_tier: "fast" напрямую в вызове Chat Completions или Responses API, совместимом с OpenAI:

python
from openai import OpenAI

client = OpenAI(
    api_key="sk-teamo-xxxxxx",
    base_url="https://api.teamorouter.com/v1",
)

resp = client.responses.create(
    model="gpt-5.6-sol",
    input="Refactor this function to reduce its cyclomatic complexity.",
    service_tier="fast",  # Fast mode (formerly "priority")
)
print(resp.output_text)

Устаревшее значение по-прежнему работает:

json
"service_tier": "priority"

И fast, и priority применимы ко всем моделям серии GPT, которые поддерживают этот уровень, а gpt-5.6-sol с включённым Fast работает до 2.5x быстрее, чем в Standard. Учтите, что для GPT-5.6 и более ранних моделей поле service_tier в объекте ответа может по-прежнему возвращать "priority" — это ожидаемо и ни на что не влияет.

Итог

Codex Fast mode — это опция скорости, а не прокачка возможностей. Для интерактивной работы, чувствительной к задержкам, он действительно полезен; для пакетных и фоновых задач это чистый расход. Три вещи, которые стоит запомнить:

  1. /fast — это переключатель: включайте его на сессию или закрепите service_tier = "fast" в config.toml.
  2. Он стоит 2-2.5x: 2.5x кредитов для GPT-5.6/5.5, 2x для GPT-5.4; в режиме API — двойная официальная цена токенов.
  3. Скидка шлюза сохраняется: через TeamoRouter Fast mode тарифицируется по двойной официальной цене с сохранением действующей скидки аккаунта, а в биллинге такие запросы помечены подсказкой «Fast».

Если вы и так расплачиваетесь задержками при настройках по умолчанию, Fast mode — самый дешёвый способ купить отзывчивость, не меняя модель. Если задержка вас не ограничивает, оставьте его выключенным — пусть работает Standard.

FAQ

Делает ли Fast mode Codex умнее?

Нет. Fast mode меняет только скорость и стабильность генерации токенов, но не модель и не её интеллект. На один и тот же вопрос в любом режиме отвечает одна и та же модель.

Какие модели поддерживают Codex Fast mode?

GPT-5.6, GPT-5.5 и GPT-5.4. Неподдерживаемые модели молча откатываются к Standard — без ошибок и без скрытых списаний.

Fast mode и Codex-Spark — одно и то же?

Нет. Codex-Spark — отдельная, более лёгкая модель, оптимизированная для быстрых итераций, со своими лимитами использования. Fast mode ускоряет уже существующую поддерживаемую модель ценой большего расхода кредитов. Это разные функции, и их можно сочетать.

Почему Fast mode расходует больше баланса?

Потому что он тарифицируется по двойной официальной цене стандартной модели, а в режиме кредитов ChatGPT — с расходом кредитов в 2-2.5x. Скидка вашего аккаунта (если она есть) по-прежнему применяется к двойной официальной цене, поэтому после скидки соотношение получается не ровно 2x.

Я использую API-ключ, а не ChatGPT — /fast работает так же?

Не совсем. При оплате по API-ключу с вас берут деньги за токены, так что множитель кредитов ChatGPT не действует. Скоростным уровнем вы управляете через service_tier — либо командой /fast, если клиент её поддерживает, либо прямо в теле запроса. Через TeamoRouter укажите service_tier: "fast", и двойная официальная цена с вашей скидкой будет списываться прозрачно.

Как выключить Fast mode?

Введите /fast ещё раз, чтобы выключить режим на текущую сессию, или удалите строку service_tier = "fast" из ~/.codex/config.toml. Чтобы убедиться, какие запросы прошли в Fast mode, найдите подсказку «Fast» у запросов в интерфейсе биллинга.

Начните работать с Codex через TeamoRouter

Fast mode — небольшой рычаг, но помогает он, только если бэкенд Codex доступен и его цены адекватны. TeamoRouter даёт один API-ключ для Codex, Claude Code и Gemini CLI, пополнение через Alipay/WeChat Pay, скидки с плавающей ставкой и прямой доступ из сетей с ограничениями.

  1. Зарегистрируйтесь в TeamoRouter
  2. Создайте API-ключ в консоли
  3. Направьте Codex на https://api.teamorouter.com/v1 и включайте /fast, когда нужна скорость

Настроить быстрый Codex →

Стабильный доступ к Codex, Claude Code и Gemini CLI через TeamoRouter — один ключ, один base URL, Fast mode включён.

Готовы подключиться?Войдите в консоль, пополните баланс и создайте API-ключ.
Codex Fast mode: всё, что нужно знать разработчику в 2026 году · TeamoRouter