Claude Opus 5.5 já está disponível no SeedRouter

O que é o Ox Alpha? O modelo stealth revelado como Z.ai GLM-5.3-Flash

Ox Alpha era o nome anônimo do Z.ai GLM-5.3-Flash no OpenRouter e no OpenCode. Quem criou, especificações, se ainda é grátis e como usar agora.

Ler em Markdown

Ox Alpha era o nome de teste anônimo do GLM-5.3-Flash, um modelo da Z.ai para programação e agentes. Ele apareceu no OpenRouter e no OpenCode como modelo "stealth" em 20 de agosto de 2026, sem nome de criador. Em 26 de agosto, a Z.ai lançou o GLM-5.3-Flash e confirmou que ele era o Ox Alpha. O nome ox-alpha não funciona mais; para usar o mesmo modelo hoje, chame o GLM-5.3-Flash. Todos os dados abaixo vêm da Z.ai, do OpenRouter ou do OpenCode, consultados em 29 de setembro de 2026.

Quem criou o Ox Alpha?

A Z.ai. O post de lançamento do GLM-5.3-Flash diz que, antes do lançamento, a empresa "testou o GLM-5.3-Flash anonimamente como ox-alpha no OpenCode e no OpenRouter para coletar feedback dos usuários", e que "ele rapidamente se tornou o modelo mais popular da semana".

A página do modelo no OpenRouter confirma: "Este modelo stealth foi desenvolvido e operado pela ZAI, e foi revelado como ZAI GLM-5.3-Flash". O OpenCode agora lista o modelo como GLM-5.3-Flash, "antes ox-alpha".

Enquanto era anônimo, as pessoas apostavam em Gemini, em um modelo GLM e em outros. O palpite do GLM chegou perto, mas não acertou em cheio: o Ox Alpha é o GLM-5.3-Flash, não o GLM-5.3, que a Z.ai lançou separadamente como modelo só de texto.

O que era um "modelo stealth"?

Um modelo que um laboratório coloca em uma plataforma pública com um codinome antes do lançamento, para coletar uso real e feedback. O OpenRouter hospeda esses modelos com o prefixo stealth/; o ID do Ox Alpha era stealth/ox-alpha. Quando o laboratório anuncia o modelo, o OpenRouter revela quem o fez e aponta para o nome real do modelo.

Quais são as especificações do Ox Alpha?

Estas são as especificações publicadas do GLM-5.3-Flash, o modelo por trás do Ox Alpha:

EspecificaçãoValor
DesenvolvedorZ.ai
Lançamento stealth20 de agosto de 2026, no OpenRouter e no OpenCode
Lançamento oficial26 de agosto de 2026, como GLM-5.3-Flash
Parâmetros320B no total, 18B ativos
Arquitetura"Uma arquitetura híbrida que combina atenção esparsa e linear"
Janela de contexto1.048.576 tokens (1M)
Saída máxima128K tokens
EntradaTexto, imagens e vídeo (a documentação da Z.ai também lista arquivos)
SaídaTexto
PesosPúblicos no Hugging Face sob a licença MIT
ID do modeloglm-5.3-flash na API da Z.ai; z-ai/glm-5.3-flash no OpenRouter

O OpenRouter descrevia o Ox Alpha como "um modelo de raciocínio projetado para programação, trabalho agêntico contínuo e cargas de produção". Para entender como a janela de contexto e o limite de saída funcionam juntos, veja janela de contexto vs máximo de tokens de saída.

O Ox Alpha é bom?

A Z.ai publicou esta comparação no post de lançamento do GLM-5.3-Flash:

BenchmarkGLM-5.3-FlashGLM-5.2Claude Opus 4.8GPT-5.6 TerraGemini 3.7 Flash
Terminal Bench 2.184.381.085.087.485.8
DeepSWE v1.163.446.258.069.665.3
AutomationBench v1.0.648.826.241.037.252.3

A Z.ai resume como "se aproximando do Claude Opus 4.8 no geral". Ela acrescenta que, no seu benchmark interno Z.ai Code Bench v1.0, o modelo "com esforço máximo quase empata com o Claude Opus 4.8 (29.0 vs. 29.5)", e que ele marca 57 no Artificial Analysis Intelligence Index v4.1.1 "por apenas $0,045 por tarefa (com desconto)".

São resultados do próprio desenvolvedor em benchmarks escolhidos por ele. Teste o modelo nas suas próprias tarefas antes de depender dele.

O Ox Alpha ainda é grátis?

Não, e o próprio nome ox-alpha deixou de existir. A listagem stealth/ox-alpha do OpenRouter não tem endpoints ativos, e o modelo não aparece mais na lista de modelos. O teste foi de 20 de agosto até a Z.ai lançar o GLM-5.3-Flash em 26 de agosto. Como a listagem saiu do ar, o preço durante o teste não pode mais ser conferido no OpenRouter nem na Z.ai.

O GLM-5.3-Flash agora é um modelo pago. A página de preços da Z.ai o lista a $0,15 por milhão de tokens de entrada, $0,03 por milhão de tokens de entrada em cache e $0,50 por milhão de tokens de saída. O OpenRouter lista as mesmas tarifas de entrada e saída para z-ai/glm-5.3-flash. Os preços mudam, então confira as duas páginas antes de fechar.

Como uso o Ox Alpha agora?

Chame o GLM-5.3-Flash pelo nome real. Há três formas:

  1. API da Z.ai, com o código de modelo glm-5.3-flash.
  2. OpenRouter, com o ID de modelo z-ai/glm-5.3-flash.
  3. OpenCode, onde o modelo agora aparece como GLM-5.3-Flash.

Agentes de programação que permitem definir uma URL base e um nome de modelo podem usá-lo por qualquer uma das duas APIs. A Z.ai também lançou uma variante mais nova, o GLM-5.3-FlashX; o código de modelo dele é glm-5.3-flashx.

Posso rodar o Ox Alpha localmente?

Os pesos são públicos. O post de lançamento da Z.ai diz: "Os pesos do modelo GLM-5.3-Flash estão disponíveis publicamente no Hugging Face". O model card indica a licença MIT. Com 320 bilhões de parâmetros no total, rodá-lo exige hardware de data center com várias GPUs, mesmo que só 18 bilhões fiquem ativos por token, então a maioria das pessoas o chama por uma API.

Meus prompts foram guardados enquanto ele era um modelo stealth?

A página do OpenRouter diz que prompts e respostas desse modelo "foram retidos" pela empresa que o operava, a Z.ai, e "não são usados para treinamento". Se você enviou código privado ao Ox Alpha pelo OpenRouter, parta do princípio de que a Z.ai guardou.

Quais são as alternativas ao Ox Alpha para agentes de programação?

Se você quer um modelo de programação que possa chamar do Claude Code ou do Codex com uma única chave e cobrança por uso, estes modelos estão disponíveis hoje no SeedRouter:

O SeedRouter não oferece o GLM-5.3-Flash. Você recarrega uma vez, sem assinatura, os créditos nunca expiram e uma requisição que falha não é cobrada. Os preços atuais estão na página de cada modelo.

Perguntas frequentes

O Ox Alpha é GLM?

Sim. O Ox Alpha era o GLM-5.3-Flash da Z.ai. A Z.ai confirmou isso ao lançar o modelo em 26 de agosto de 2026, e a página do OpenRouter agora diz o mesmo.

O Ox Alpha é chinês?

Foi feito pela Z.ai, que diz que todo o tráfego do teste stealth foi "servido em chips de IA chineses".

O Ox Alpha é open source?

Os pesos, sim. O GLM-5.3-Flash está no Hugging Face sob a licença MIT.

Por que o Ox Alpha sumiu?

Porque o teste acabou. Quando a Z.ai lançou o GLM-5.3-Flash, o nome ox-alpha foi aposentado e o modelo passou a usar o nome real.

O Ox Alpha é melhor que o Claude?

A Z.ai informa que o GLM-5.3-Flash com esforço máximo "quase empata com o Claude Opus 4.8" no próprio Code Bench. É um único benchmark do desenvolvedor do modelo, não uma comparação independente.

Guias relacionados