Блог

Ox Alpha (GLM-5.3-Flash): что это за модель и как получить бесплатный доступ

Короткий ответ

Ox Alpha — это GLM-5.3-Flash, передовая модель с открытым исходным кодом от Zhipu AI. Под этим анонимным именем она без анонсов появилась на OpenRouter и OpenCode 20 августа 2026 года, в первый же день вышла на первое место OpenRouter, установила новый рекорд суточного использования и потребила примерно 62 триллиона токенов за шесть дней, прежде чем 26 августа Zhipu раскрыла, кто за ней стоит.

  • Кто это: Ox Alpha = GLM-5.3-Flash (в китайском сообществе разработчиков её называют «牛来» — модель «Бык»).
  • Характеристики: 320B параметров всего / 18B активных, 92→45 слоёв, контекст 1.04M токенов, нативная мультимодальность (текст/изображения/видео/файлы), открытый код под лицензией MIT.
  • Производительность: AA Intelligence Index 57 — наравне с Claude Opus 4.8 и выше DeepSeek V4 Pro (53).
  • Цены: ¥0.8 за вход / ¥2.8 за выход за 1M токенов в Китае (примерно 1/10 от GLM-5.3); $0.3 за вход / $1.2 за выход на международном рынке (примерно 1/40 от Claude Opus 4.8).
  • Бесплатный доступ: бонусный уровень TeamoRouter glm-5.3-flash-free даёт 200 бесплатных запросов в день — зарегистрируйтесь, получите ключ и обращайтесь к модели через OpenAI-совместимый API. У платной glm-5.3-flash суточного лимита нет.

Шестидневный слепой тест, который побил рекорды OpenRouter

Ox Alpha пришла без пресс-релиза. 20 августа 2026 года её выложили на OpenRouter и OpenCode как анонимную модель — без названия компании, без описания архитектуры. Разработчики проголосовали трафиком:

  • Первый день: взлёт на 1-е место OpenRouter и рекорд платформы по суточному использованию — в 4 раза выше предыдущего пика.
  • OpenCode: прервала 56-дневное лидерство DeepSeek в рейтинге.
  • Шесть дней (20–26 августа): примерно 62 триллиона токенов по всему миру, около 20% недельного трафика OpenRouter, более чем в 2 раза больше, чем у DeepSeek.
  • 26 августа: Zhipu раскрыла карты — Ox Alpha оказалась GLM-5.3-Flash, и тем же вечером модель открыли под лицензией MIT. Акции Zhipu (02513.HK) выросли на 12.62%, а капитализация снова превысила 500 млрд HKD.

Почему «Ox»? Кодовое имя по-английски означает «бык», а в Китае в это же время в трендах был фильм 《牛来》 — поэтому китайские разработчики стали называть её «моделью 牛来» («бык идёт»). В китайских технических сообществах «牛来模型» и «Ox Alpha» теперь означают одно и то же.

Основные характеристики

Характеристика GLM-5.3-Flash
Всего параметров 320B
Активных параметров 18B
Слои 92 → 45
Контекстное окно 1.04M токенов
Мультимодальность Текст / изображения / видео / файлы на входе
AA Intelligence Index 57 (наравне с Claude Opus 4.8)
Архитектура Разреженное внимание + линейное внимание + гиперсвязи с ограничением на многообразии (mHC)
Лицензия MIT
Инференс 100K китайских чипов

Три главных вывода:

  1. Это MoE-модель — 320B всего, 18B активных. Объём знаний флагмана за малую долю стоимости токена.
  2. 92→45 слоёв — облегчённый стек вместе с гибридным вниманием и делает обслуживание контекста в 1.04M токенов доступным по цене.
  3. Первая в своём роде — это первая передовая модель с открытым исходным кодом, объединившая разреженное внимание с линейным и добавившая новые гиперсвязи с ограничением на многообразии (mHC).

Производительность: наравне с Claude Opus 4.8

По Artificial Analysis Intelligence Index GLM-5.3-Flash набирает 57 — столько же, сколько Claude Opus 4.8 от Anthropic, и больше, чем DeepSeek V4 Pro с его 53. Это первое место среди открытых моделей по общему интеллекту — серьёзная заявка при такой цене.

Модель открыла и новую главу для китайского железа: весь инференс-трафик идёт на кластере из 100 000 китайских чипов — это первое у Zhipu крупномасштабное развёртывание отечественных чипов для инференса. Это и заявление о цепочке поставок, и во многом причина, по которой цена может быть такой низкой.

Цены: Передовые возможности по доступной цене

Цены в Китае (за 1M токенов):

Позиция Цена
Вход ¥0.8
Выход ¥2.8

Это примерно 1/10 от GLM-5.3, а во время ограниченной по срокам акции с половинной ценой — примерно 1/20.

Международные цены (за 1M токенов):

Позиция Цена
Вход $0.3
Выход $1.2 ($0.6 на время половинной цены)

Это примерно 1/40 от официальной цены Claude Opus 4.8, а по словам Zhipu, итоговый счёт выходит даже ниже, чем у DeepSeek V4-Flash после корректировки цен. Коротко: открытая модель, интеллект передового уровня, цена ширпотреба.

Сравнение: DeepSeek V4 и Claude Opus 4.8

  • против DeepSeek V4 Pro: GLM-5.3-Flash впереди по AA Intelligence Index (57 против 53). За анонимную неделю она собрала на OpenRouter более чем в 2 раза больше трафика, чем DeepSeek. Обе модели стоят «копейки», так что выбор сводится к интеллекту и мультимодальным возможностям — и здесь GLM немного впереди.
  • против Claude Opus 4.8: одинаковый балл AA (57) — это и есть главная новость. Разница — в счёте: международная цена составляет примерно 1/40 от официального тарифа Opus 4.8, а GLM-5.3-Flash к тому же открыта под MIT, так что тот же интеллект можно развернуть у себя, а не арендовать.

Итог одной строкой: интеллект закрытого флагмана по цене открытой модели. Для китайских разработчиков эта арифметика — вместе с доступом без прокси и оплатой через Alipay в шлюзе вроде TeamoRouter — делает её самой доступной из передовых моделей для реального использования в больших объёмах.

Бесплатный доступ: 3 пути к GLM-5.3-Flash

Пользоваться GLM-5.3-Flash бесплатно можно тремя способами:

Путь Квота Усилия
Бонусный уровень TeamoRouter glm-5.3-flash-free 200 запросов в день Регистрация + API-ключ, несколько минут
GLM Coding Plan 10 000 пробных карт в день (ограничено, нужно успеть получить) Официальная платформа Zhipu
Самостоятельный хостинг (открытый код, MIT) Без ограничений (ваши собственные GPU) Нужен кластер из нескольких GPU

Для большинства разработчиков бонусный уровень TeamoRouter — самый быстрый бесплатный путь: без GPU, без зарубежной карты, без охоты за пробными картами — и это настоящий API, к которому можно обращаться из кода.

Как получить бесплатный доступ в TeamoRouter

1. Зарегистрируйтесь и создайте ключ

Зарегистрируйтесь в TeamoRouter и создайте API-ключ (sk-teamo-...). Сервис удобен для Китая: пополнение через Alipay, прокси не нужен, неудачные запросы не тарифицируются — а бесплатный уровень не стоит ничего.

2. Убедитесь, что модель доступна

Запросите актуальный список моделей:

bash
curl https://api.teamorouter.cn/v1/models \
  -H "Authorization: Bearer sk-teamo-your-key"

Найдите в нём glm-5.3-flash, glm-5.3-flash-free (бонусный уровень), glm-5.3 и glm-5.2.

3. Вызовите модель (OpenAI-совместимый API)

GLM использует OpenAI-совместимый эндпоинт POST /v1/chat/completions с base URL https://api.teamorouter.cn/v1. Обратите внимание: /v1/responses предназначен только для серии GPT — GLM с ним не работает.

cURL:

bash
curl https://api.teamorouter.cn/v1/chat/completions \
  -H "Authorization: Bearer sk-teamo-your-key" \
  -H "content-type: application/json" \
  -d '{
    "model": "glm-5.3-flash-free",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "Write a Python quicksort"}]
  }'

Python (openai SDK):

python
from openai import OpenAI

client = OpenAI(
    api_key="sk-teamo-your-key",
    base_url="https://api.teamorouter.cn/v1",
)

resp = client.chat.completions.create(
    model="glm-5.3-flash-free",
    messages=[{"role": "user", "content": "Write a Python quicksort"}],
)
print(resp.choices[0].message.content)

Node:

javascript
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "sk-teamo-your-key",
  baseURL: "https://api.teamorouter.cn/v1",
});

const resp = await client.chat.completions.create({
  model: "glm-5.3-flash-free",
  messages: [{ role: "user", content: "Write a Python quicksort" }],
});
console.log(resp.choices[0].message.content);

4. Подключите Claude Code / Codex

Один ключ TeamoRouter понимает и протокол Anthropic, и протокол OpenAI, поэтому GLM-5.3-Flash можно запустить внутри Claude Code:

bash
export ANTHROPIC_BASE_URL="https://api.teamorouter.cn"
export ANTHROPIC_AUTH_TOKEN="sk-teamo-your-key"
export ANTHROPIC_MODEL="glm-5.3-flash-free"
export ANTHROPIC_SMALL_FAST_MODEL="glm-5.3-flash-free"

Или в Codex и других инструментах на протоколе OpenAI:

bash
export OPENAI_BASE_URL="https://api.teamorouter.cn/v1"
export OPENAI_API_KEY="sk-teamo-your-key"

Когда бесплатная квота закончится

Два запасных варианта — с тем же ключом, без повторной регистрации:

  1. Перейдите на платную glm-5.3-flash — поменяйте только поле model. Суточного лимита запросов нет, а цена всё равно очень низкая (¥0.8/¥2.8 за 1M в Китае).
  2. Переключитесь на бонусные уровни DeepSeek — в TeamoRouter есть ещё deepseek-v4-flash-free (200 в день) и deepseek-v4-pro-free (50 в день). Квоты GLM и DeepSeek считаются отдельно, так что один ключ фактически даёт вам двойной бесплатный запас.

FAQ

Ox Alpha и GLM-5.3-Flash — это одно и то же?

Да. Ox Alpha — анонимное имя модели в слепом тесте с 20 августа; 26 августа Zhipu подтвердила, что это GLM-5.3-Flash.

У GLM-5.3-Flash открытый исходный код?

Да — лицензия MIT, релиз 26 августа 2026 года. Модель можно развернуть у себя.

glm-5.3-flash-free действительно бесплатна, 200 раз в день?

Да. Правило бонусного уровня TeamoRouter: модели с окончанием -free получают суточную квоту запросов — для glm-5.3-flash-free это 200 запросов в день (RPD), квота обновляется ежедневно.

Может ли GLM работать через /v1/responses?

Нет. /v1/responses — только для серии GPT. Для GLM используйте /v1/chat/completions.

Нужен ли GPU или зарубежная карта?

Нет. Для бонусного уровня TeamoRouter не нужно ни то ни другое — только ключ sk-teamo-.

Итог

Ox Alpha / GLM-5.3-Flash — главное событие августа 2026 года в мире моделей: шестидневный анонимный слепой тест, побивший рекорды OpenRouter, интеллект передового уровня (AA 57) за малую долю цены флагманов, открытый код под MIT и работа на кластере из 100K китайских чипов. Самый быстрый способ попробовать модель — причём бесплатно — бонусный уровень TeamoRouter glm-5.3-flash-free с 200 запросами в день. Один ключ маршрутизирует GLM наравне с Claude, GPT, DeepSeek, Kimi, Gemini и Grok, с единым биллингом.

Получите ключ TeamoRouter и 200 бесплатных запросов к GLM-5.3-Flash в день, а затем подключите его к Claude Code, Codex или любому OpenAI-совместимому инструменту.

Готовы подключиться?Войдите в консоль, пополните баланс и создайте API-ключ.
Ox Alpha (GLM-5.3-Flash): что это за модель и как получить бесплатный доступ · TeamoRouter