Оценивать реселлеров только по цене бессмысленно: реальная стоимость часто прячется в доле попаданий в кэш, стабильности и деградации качества моделей. В честном сравнении нужно зафиксировать пять измерений — долю попаданий в кэш, стабильность (SLA и параллелизм), цены, совместимость протоколов и подмену моделей (деградацию качества) — и прогнать одни и те же реальные задачи в одном и том же временном окне, чтобы результаты были воспроизводимы. В этой статье мы описываем такую воспроизводимую методику, сравниваем с её помощью основные подходы и показываем, какое место в этой системе координат занимает TeamoRouter.
Почему в обзорах реселлеров нельзя смотреть только на заявленные цены
Поиск по запросу «обзор реселлеров Claude» в соцсетях выдаёт в основном рекомендации из личного опыта или единичные жалобы — структурированных, воспроизводимых сравнений там нет. Проблема в том, что реселлеров на самом деле отличает не цена с баннера «скидка 90%», а несколько невидимых метрик:
- Доля попаданий в кэш: в агентных сценариях вроде Claude/Codex одни и те же системные промпты и контекст передаются снова и снова. Попадания в кэш тарифицируются по кэш-цене, которая может быть на порядок ниже. Рост доли попаданий с 60% до 99% по сути даёт ещё одну огромную скидку на ваши фактические расходы. У двух сервисов с одинаковой заявленной ценой, но разной долей попаданий реальные затраты могут отличаться в разы.
- Стабильность: отдаёт ли сервис результаты надёжно в вечерние пиковые часы? Каков лимит QPM (запросов в минуту)? Есть ли обязательства по SLA? От этого зависит, годится ли он как настоящий рабочий инструмент.
- Подмена моделей: рекламировать Opus/Sonnet, а в пиковые часы тихо перенаправлять запросы на модели подешевле — самая коварная ловушка среди реселлеров.
Обзор обретает смысл только тогда, когда эти измерения выражены в цифрах.
Методика оценки по пяти измерениям (воспроизводимая)
Эту методику может применить кто угодно. Рекомендуем зафиксировать временное окно (например, три дня подряд, с тестами днём и в вечерние пиковые часы) и использовать для сравнения один и тот же набор задач.
Измерение 1: доля попаданий в кэш
Запустите агентную задачу с длинным системным промптом (например, многофайловый рефакторинг в Claude Code) на несколько раундов подряд. Посмотрите в счёте, какую долю от всех токенов составляют «токены, прочитанные из кэша». Чем выше доля попаданий в кэш, тем ниже фактическая стоимость. Сервисы, которые показывают данные о попаданиях в кэш прямо в консоли, к тому же прозрачнее.
Измерение 2: стабильность (SLA / параллелизм / пиковые часы)
Отправляйте запросы непрерывно в вечерние пиковые часы (с 20:00 до 00:00 по местному времени), фиксируя долю отказов, среднюю задержку и случаи переподключений и обрывов. Проверьте, публикует ли сервис показатель SLA и лимит QPM (запросов в минуту): полагаться в долгую стоит только на тех, кто берёт на себя обязательства.
Измерение 3: цены
Требуйте общедоступную страницу тарифов с разбивкой по моделям: цены входных и выходных токенов, кэш-цены и ступенчатые скидки. Сервисы, которые называют цены только в личной переписке или не имеют публичной страницы тарифов, стоит отсеивать сразу.
Измерение 4: совместимость протоколов
Проверьте, поддерживает ли сервис нативно протокол Anthropic (для Claude Code) и /v1/responses от OpenAI (для Codex). Нативная совместимость означает, что инструменты подключаются напрямую — достаточно задать baseUrl, и локальный процесс маршрутизации на вашей машине не нужен (локальные слои маршрутизации — частый источник переподключений и конфликтов прокси).
Измерение 5: подмена моделей (деградация качества)
Попросите модель назвать себя и дайте ей задачи, которые надёжно выполняет только заявленный класс моделей (рассуждения на длинном контексте, сложный рефакторинг, мультимодальные задачи). Сравните результаты с официальным API. Прогоните одни и те же тесты днём и в вечерние пиковые часы, чтобы проверить, стабильно ли качество.
Сравнение основных подходов
Вот как распространённые подходы выглядят по пяти описанным измерениям:
| Измерение | Дешёвый реселлер на пуле аккаунтов | Зеркало / сайт-оболочка | Локальный роутер (CC Switch + прокси) | Шлюз с прямым подключением (например, TeamoRouter) |
|---|---|---|---|---|
| Доля попаданий в кэш | Непрозрачна, часто низкая | Неприменимо | Зависит от вышестоящего провайдера | Публично проверяема, высокая (>99%) |
| Стабильность | Проседает в пики, SLA нет | Зависит от доступности сайта | Страдает от конфликтов локального прокси | SLA 99.98%, 5000 QPM |
| Цены | Низкая заявленная цена, но часто «разбавленный» сервис | Ежемесячная подписка | Зависят от вышестоящего провайдера | Опубликованные ставки, плавающая ставка 10–20% от официальной цены |
| Совместимость протоколов | Частично урезана | Только веб | Нужен локальный слой преобразования | 100% совместимость с агентными протоколами |
| Подмена моделей | Часто подменяет в пики | Модель проверить невозможно | Зависит от вышестоящего провайдера | Без подмены, класс модели выбирается явно |
Как видно из таблицы, дешёвые провайдеры выигрывают по заявленной цене, но проигрывают по кэшу и стабильности. Зеркала решают только задачу «работает в браузере» и не встраиваются в рабочие процессы Codex/Claude Code. Локальные роутеры решают задачу «переключения провайдеров», но добавляют новый источник сбоев — конфликты локального прокси. Шлюзы с прямым подключением показывают самый сбалансированный результат по всем пяти измерениям.
Выводы и сценарии: где место TeamoRouter
В рамках пяти измерений TeamoRouter — это LLM-шлюз с маршрутизацией, созданный для агентных инструментов вроде Claude Code и Codex. Вот его оценки по каждому измерению:
- Доля попаданий в кэш >99%: повторяющийся контекст агентных сценариев кэшируется почти полностью, так что фактические расходы намного ниже заявленных цен;
- Стабильность: SLA 99.98%, параллелизм 5000 QPM — без просадок в вечерние пиковые часы;
- Цены: плавающая ставка 10–20% от официальной цены; актуальные цены по моделям и ступенчатые скидки опубликованы на странице тарифов (первые $25 — скидка 50%, $25-100 — скидка 20%, далее — скидка 5%);
- Совместимость протоколов: 100% совместимость с протоколом Anthropic и
/v1/responses— Claude Code и Codex подключаются напрямую, достаточно задать baseUrl, локальная маршрутизация не нужна; - Без подмены моделей: цели маршрутизации открыты и доступны для выбора. Один Key поддерживает Claude Sonnet/Opus, GPT-4o, Gemini, DeepSeek, Kimi и другие модели — класс модели вы указываете явно.
Сценарии понятны: если вы время от времени задаёте пару вопросов через веб-интерфейс, хватит и зеркала. Если же Claude Code или Codex — ваш ежедневный рабочий инструмент, то высокая доля попаданий в кэш, стабильность и отсутствие подмены моделей обязательны — и именно в этом сильны шлюзы с прямым подключением.
Практика: проведите собственную оценку за пять минут
- Зарегистрируйтесь в TeamoRouter, пополните баланс на небольшую сумму и получите API-ключ;
- Настройте baseUrl по руководству по подключению Claude Code или руководству по подключению Codex;
- Запустите реальную задачу с длинным системным промптом на несколько раундов и посмотрите долю попаданий в кэш в консоли;
- Проведите ещё один раунд в вечерние пиковые часы, фиксируя долю отказов и задержку;
- Сверьте списания со страницей тарифов: убедитесь, что ставки совпадают с опубликованными, а за неудачные запросы деньги не списываются.
Методика подходит для любого реселлера: прогоните один и тот же набор задач у разных провайдеров — и сразу станет видно, кто халтурит, кто подменяет модели, а кто работает стабильно.
Часто задаваемые вопросы
На какие метрики смотреть в обзоре реселлеров?
Зафиксируйте пять измерений: долю попаданий в кэш, стабильность (SLA, параллелизм, долю отказов в пики), цены, совместимость протоколов и подмену моделей. Если смотреть только на заявленные цены, картина будет обманчивой; честную оценку даёт только совокупность всех пяти измерений.
Почему доля попаданий в кэш так важна?
В агентных сценариях вроде Claude Code/Codex одни и те же системные промпты и контекст передаются снова и снова. Попадания в кэш тарифицируются по кэш-цене, которая может быть на порядок ниже. Рост доли попаданий с 60% до 99% по сути даёт огромную скидку на фактические расходы — это влияет на них гораздо сильнее, чем цена с баннера.
Как понять, подменяет ли реселлер модели?
Попросите модель назвать себя и дайте ей задачи, которые надёжно выполняет только заявленный класс моделей (задачи на длинный контекст, сложный рефакторинг, мультимодальные задачи). Прогоните один и тот же тест днём и в вечерние пиковые часы и сравните. Если качество заметно плавает, провайдер, скорее всего, подменяет модели в пиковые часы.
Как выбирать после сравнения?
Для постоянной рабочей нагрузки выбирайте шлюз с прямым подключением, высокой долей попаданий в кэш, SLA, нативной совместимостью протоколов и без подмены моделей. Для эпизодических экспериментов может хватить и зеркала. Более подробные советы — в руководстве по выбору реселлера для Claude Code с разбором подводных камней.