Короткий ответ
Ox Alpha — это GLM-5.3-Flash, передовая модель с открытым исходным кодом от Zhipu AI. Под этим анонимным именем она без анонсов появилась на OpenRouter и OpenCode 20 августа 2026 года, в первый же день вышла на первое место OpenRouter, установила новый рекорд суточного использования и потребила примерно 62 триллиона токенов за шесть дней, прежде чем 26 августа Zhipu раскрыла, кто за ней стоит.
- Кто это: Ox Alpha = GLM-5.3-Flash (в китайском сообществе разработчиков её называют «牛来» — модель «Бык»).
- Характеристики: 320B параметров всего / 18B активных, 92→45 слоёв, контекст 1.04M токенов, нативная мультимодальность (текст/изображения/видео/файлы), открытый код под лицензией MIT.
- Производительность: AA Intelligence Index 57 — наравне с Claude Opus 4.8 и выше DeepSeek V4 Pro (53).
- Цены: ¥0.8 за вход / ¥2.8 за выход за 1M токенов в Китае (примерно 1/10 от GLM-5.3); $0.3 за вход / $1.2 за выход на международном рынке (примерно 1/40 от Claude Opus 4.8).
- Бесплатный доступ: бонусный уровень TeamoRouter
glm-5.3-flash-freeдаёт 200 бесплатных запросов в день — зарегистрируйтесь, получите ключ и обращайтесь к модели через OpenAI-совместимый API. У платнойglm-5.3-flashсуточного лимита нет.
Шестидневный слепой тест, который побил рекорды OpenRouter
Ox Alpha пришла без пресс-релиза. 20 августа 2026 года её выложили на OpenRouter и OpenCode как анонимную модель — без названия компании, без описания архитектуры. Разработчики проголосовали трафиком:
- Первый день: взлёт на 1-е место OpenRouter и рекорд платформы по суточному использованию — в 4 раза выше предыдущего пика.
- OpenCode: прервала 56-дневное лидерство DeepSeek в рейтинге.
- Шесть дней (20–26 августа): примерно 62 триллиона токенов по всему миру, около 20% недельного трафика OpenRouter, более чем в 2 раза больше, чем у DeepSeek.
- 26 августа: Zhipu раскрыла карты — Ox Alpha оказалась GLM-5.3-Flash, и тем же вечером модель открыли под лицензией MIT. Акции Zhipu (02513.HK) выросли на 12.62%, а капитализация снова превысила 500 млрд HKD.
Почему «Ox»? Кодовое имя по-английски означает «бык», а в Китае в это же время в трендах был фильм 《牛来》 — поэтому китайские разработчики стали называть её «моделью 牛来» («бык идёт»). В китайских технических сообществах «牛来模型» и «Ox Alpha» теперь означают одно и то же.
Основные характеристики
| Характеристика | GLM-5.3-Flash |
|---|---|
| Всего параметров | 320B |
| Активных параметров | 18B |
| Слои | 92 → 45 |
| Контекстное окно | 1.04M токенов |
| Мультимодальность | Текст / изображения / видео / файлы на входе |
| AA Intelligence Index | 57 (наравне с Claude Opus 4.8) |
| Архитектура | Разреженное внимание + линейное внимание + гиперсвязи с ограничением на многообразии (mHC) |
| Лицензия | MIT |
| Инференс | 100K китайских чипов |
Три главных вывода:
- Это MoE-модель — 320B всего, 18B активных. Объём знаний флагмана за малую долю стоимости токена.
- 92→45 слоёв — облегчённый стек вместе с гибридным вниманием и делает обслуживание контекста в 1.04M токенов доступным по цене.
- Первая в своём роде — это первая передовая модель с открытым исходным кодом, объединившая разреженное внимание с линейным и добавившая новые гиперсвязи с ограничением на многообразии (mHC).
Производительность: наравне с Claude Opus 4.8
По Artificial Analysis Intelligence Index GLM-5.3-Flash набирает 57 — столько же, сколько Claude Opus 4.8 от Anthropic, и больше, чем DeepSeek V4 Pro с его 53. Это первое место среди открытых моделей по общему интеллекту — серьёзная заявка при такой цене.
Модель открыла и новую главу для китайского железа: весь инференс-трафик идёт на кластере из 100 000 китайских чипов — это первое у Zhipu крупномасштабное развёртывание отечественных чипов для инференса. Это и заявление о цепочке поставок, и во многом причина, по которой цена может быть такой низкой.
Цены: Передовые возможности по доступной цене
Цены в Китае (за 1M токенов):
| Позиция | Цена |
|---|---|
| Вход | ¥0.8 |
| Выход | ¥2.8 |
Это примерно 1/10 от GLM-5.3, а во время ограниченной по срокам акции с половинной ценой — примерно 1/20.
Международные цены (за 1M токенов):
| Позиция | Цена |
|---|---|
| Вход | $0.3 |
| Выход | $1.2 ($0.6 на время половинной цены) |
Это примерно 1/40 от официальной цены Claude Opus 4.8, а по словам Zhipu, итоговый счёт выходит даже ниже, чем у DeepSeek V4-Flash после корректировки цен. Коротко: открытая модель, интеллект передового уровня, цена ширпотреба.
Сравнение: DeepSeek V4 и Claude Opus 4.8
- против DeepSeek V4 Pro: GLM-5.3-Flash впереди по AA Intelligence Index (57 против 53). За анонимную неделю она собрала на OpenRouter более чем в 2 раза больше трафика, чем DeepSeek. Обе модели стоят «копейки», так что выбор сводится к интеллекту и мультимодальным возможностям — и здесь GLM немного впереди.
- против Claude Opus 4.8: одинаковый балл AA (57) — это и есть главная новость. Разница — в счёте: международная цена составляет примерно 1/40 от официального тарифа Opus 4.8, а GLM-5.3-Flash к тому же открыта под MIT, так что тот же интеллект можно развернуть у себя, а не арендовать.
Итог одной строкой: интеллект закрытого флагмана по цене открытой модели. Для китайских разработчиков эта арифметика — вместе с доступом без прокси и оплатой через Alipay в шлюзе вроде TeamoRouter — делает её самой доступной из передовых моделей для реального использования в больших объёмах.
Бесплатный доступ: 3 пути к GLM-5.3-Flash
Пользоваться GLM-5.3-Flash бесплатно можно тремя способами:
| Путь | Квота | Усилия |
|---|---|---|
Бонусный уровень TeamoRouter glm-5.3-flash-free |
200 запросов в день | Регистрация + API-ключ, несколько минут |
| GLM Coding Plan | 10 000 пробных карт в день (ограничено, нужно успеть получить) | Официальная платформа Zhipu |
| Самостоятельный хостинг (открытый код, MIT) | Без ограничений (ваши собственные GPU) | Нужен кластер из нескольких GPU |
Для большинства разработчиков бонусный уровень TeamoRouter — самый быстрый бесплатный путь: без GPU, без зарубежной карты, без охоты за пробными картами — и это настоящий API, к которому можно обращаться из кода.
Как получить бесплатный доступ в TeamoRouter
1. Зарегистрируйтесь и создайте ключ
Зарегистрируйтесь в TeamoRouter и создайте API-ключ (sk-teamo-...). Сервис удобен для Китая: пополнение через Alipay, прокси не нужен, неудачные запросы не тарифицируются — а бесплатный уровень не стоит ничего.
2. Убедитесь, что модель доступна
Запросите актуальный список моделей:
curl https://api.teamorouter.cn/v1/models \
-H "Authorization: Bearer sk-teamo-your-key"
Найдите в нём glm-5.3-flash, glm-5.3-flash-free (бонусный уровень), glm-5.3 и glm-5.2.
3. Вызовите модель (OpenAI-совместимый API)
GLM использует OpenAI-совместимый эндпоинт POST /v1/chat/completions с base URL https://api.teamorouter.cn/v1. Обратите внимание: /v1/responses предназначен только для серии GPT — GLM с ним не работает.
cURL:
curl https://api.teamorouter.cn/v1/chat/completions \
-H "Authorization: Bearer sk-teamo-your-key" \
-H "content-type: application/json" \
-d '{
"model": "glm-5.3-flash-free",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Write a Python quicksort"}]
}'
Python (openai SDK):
from openai import OpenAI
client = OpenAI(
api_key="sk-teamo-your-key",
base_url="https://api.teamorouter.cn/v1",
)
resp = client.chat.completions.create(
model="glm-5.3-flash-free",
messages=[{"role": "user", "content": "Write a Python quicksort"}],
)
print(resp.choices[0].message.content)
Node:
import OpenAI from "openai";
const client = new OpenAI({
apiKey: "sk-teamo-your-key",
baseURL: "https://api.teamorouter.cn/v1",
});
const resp = await client.chat.completions.create({
model: "glm-5.3-flash-free",
messages: [{ role: "user", content: "Write a Python quicksort" }],
});
console.log(resp.choices[0].message.content);
4. Подключите Claude Code / Codex
Один ключ TeamoRouter понимает и протокол Anthropic, и протокол OpenAI, поэтому GLM-5.3-Flash можно запустить внутри Claude Code:
export ANTHROPIC_BASE_URL="https://api.teamorouter.cn"
export ANTHROPIC_AUTH_TOKEN="sk-teamo-your-key"
export ANTHROPIC_MODEL="glm-5.3-flash-free"
export ANTHROPIC_SMALL_FAST_MODEL="glm-5.3-flash-free"
Или в Codex и других инструментах на протоколе OpenAI:
export OPENAI_BASE_URL="https://api.teamorouter.cn/v1"
export OPENAI_API_KEY="sk-teamo-your-key"
Когда бесплатная квота закончится
Два запасных варианта — с тем же ключом, без повторной регистрации:
- Перейдите на платную
glm-5.3-flash— поменяйте только полеmodel. Суточного лимита запросов нет, а цена всё равно очень низкая (¥0.8/¥2.8 за 1M в Китае). - Переключитесь на бонусные уровни DeepSeek — в TeamoRouter есть ещё
deepseek-v4-flash-free(200 в день) иdeepseek-v4-pro-free(50 в день). Квоты GLM и DeepSeek считаются отдельно, так что один ключ фактически даёт вам двойной бесплатный запас.
FAQ
Ox Alpha и GLM-5.3-Flash — это одно и то же?
Да. Ox Alpha — анонимное имя модели в слепом тесте с 20 августа; 26 августа Zhipu подтвердила, что это GLM-5.3-Flash.
У GLM-5.3-Flash открытый исходный код?
Да — лицензия MIT, релиз 26 августа 2026 года. Модель можно развернуть у себя.
glm-5.3-flash-free действительно бесплатна, 200 раз в день?
Да. Правило бонусного уровня TeamoRouter: модели с окончанием -free получают суточную квоту запросов — для glm-5.3-flash-free это 200 запросов в день (RPD), квота обновляется ежедневно.
Может ли GLM работать через /v1/responses?
Нет. /v1/responses — только для серии GPT. Для GLM используйте /v1/chat/completions.
Нужен ли GPU или зарубежная карта?
Нет. Для бонусного уровня TeamoRouter не нужно ни то ни другое — только ключ sk-teamo-.
Итог
Ox Alpha / GLM-5.3-Flash — главное событие августа 2026 года в мире моделей: шестидневный анонимный слепой тест, побивший рекорды OpenRouter, интеллект передового уровня (AA 57) за малую долю цены флагманов, открытый код под MIT и работа на кластере из 100K китайских чипов. Самый быстрый способ попробовать модель — причём бесплатно — бонусный уровень TeamoRouter glm-5.3-flash-free с 200 запросами в день. Один ключ маршрутизирует GLM наравне с Claude, GPT, DeepSeek, Kimi, Gemini и Grok, с единым биллингом.
Получите ключ TeamoRouter и 200 бесплатных запросов к GLM-5.3-Flash в день, а затем подключите его к Claude Code, Codex или любому OpenAI-совместимому инструменту.