Claude Opus 5.5 è disponibile su SeedRouter

Cos'è Ox Alpha? Il modello stealth rivelato come GLM-5.3-Flash di Z.ai

Ox Alpha era il nome anonimo di GLM-5.3-Flash di Z.ai su OpenRouter e OpenCode. Chi l'ha creato, le specifiche, se è ancora gratis e come usarlo ora.

Leggi in Markdown

Ox Alpha era il nome di test anonimo di GLM-5.3-Flash, un modello di Z.ai per il coding e gli agenti. È comparso su OpenRouter e OpenCode come modello "stealth" il 20 agosto 2026, senza che fosse indicato chi l'avesse creato. Il 26 agosto Z.ai ha rilasciato GLM-5.3-Flash e ha confermato che si trattava di Ox Alpha. Il nome ox-alpha non funziona più; per usare lo stesso modello oggi, chiama GLM-5.3-Flash. Ogni informazione qui sotto viene da Z.ai, OpenRouter o OpenCode, verificata il 29 settembre 2026.

Chi ha creato Ox Alpha?

Z.ai. Il post di lancio di GLM-5.3-Flash dice che prima del rilascio l'azienda "ha testato GLM-5.3-Flash in forma anonima come ox-alpha su OpenCode e OpenRouter per raccogliere il feedback degli utenti", e che "è diventato rapidamente il modello più popolare della settimana".

La pagina del modello su OpenRouter lo conferma: "Questo modello stealth è stato sviluppato e gestito da ZAI, e si è rivelato essere ZAI GLM-5.3-Flash." OpenCode ora elenca il modello come GLM-5.3-Flash, "Formerly ox-alpha" (cioè "in precedenza ox-alpha").

Mentre era anonimo, si ipotizzava che fosse Gemini, un modello GLM o altro. L'ipotesi GLM era vicina ma non esatta: Ox Alpha è GLM-5.3-Flash, non GLM-5.3, che Z.ai ha rilasciato separatamente come modello solo testo.

Cos'era un "modello stealth"?

Un modello che un laboratorio pubblica su una piattaforma aperta con un nome in codice prima del lancio, per raccogliere utilizzo reale e feedback. OpenRouter ospita questi modelli con il prefisso stealth/; l'ID di Ox Alpha era stealth/ox-alpha. Quando il laboratorio annuncia il modello, OpenRouter rivela chi l'ha creato e rimanda al suo vero nome.

Quali sono le specifiche di Ox Alpha?

Queste sono le specifiche pubblicate di GLM-5.3-Flash, il modello dietro Ox Alpha:

SpecificaValore
SviluppatoreZ.ai
Rilascio stealth20 agosto 2026, su OpenRouter e OpenCode
Rilascio ufficiale26 agosto 2026, come GLM-5.3-Flash
Parametri320 miliardi in totale, 18 miliardi attivi
Architettura"Un'architettura ibrida che combina attenzione sparsa e lineare"
Finestra di contesto1.048.576 token (1M)
Output massimo128K token
InputTesto, immagini e video (la documentazione di Z.ai elenca anche i file)
OutputTesto
PesiPubblici su Hugging Face con licenza MIT
ID modelloglm-5.3-flash sull'API di Z.ai; z-ai/glm-5.3-flash su OpenRouter

OpenRouter descriveva Ox Alpha come "un modello di ragionamento progettato per il coding, il lavoro agentico prolungato e i carichi di lavoro in produzione." Per capire come funzionano insieme la finestra di contesto e il limite di output, leggi Finestra di contesto e token di output massimi.

Quanto è bravo Ox Alpha?

Z.ai ha pubblicato questo confronto nel post di lancio di GLM-5.3-Flash:

BenchmarkGLM-5.3-FlashGLM-5.2Claude Opus 4.8GPT-5.6 TerraGemini 3.7 Flash
Terminal Bench 2.184.381.085.087.485.8
DeepSWE v1.163.446.258.069.665.3
AutomationBench v1.0.648.826.241.037.252.3

Z.ai lo riassume così: "si avvicina a Claude Opus 4.8 nel complesso". Aggiunge che sul suo benchmark interno Z.ai Code Bench v1.0 il modello "allo sforzo massimo eguaglia quasi Claude Opus 4.8 (29.0 contro 29.5)", e che ottiene 57 sull'Artificial Analysis Intelligence Index v4.1.1 "a soli $0,045 per task (scontato)".

Sono risultati dello sviluppatore stesso, su benchmark scelti da lui. Prova il modello sui tuoi compiti prima di farci affidamento.

Ox Alpha è ancora gratis?

No, e il nome ox-alpha stesso non esiste più. Il listing stealth/ox-alpha su OpenRouter non ha endpoint attivi, e il modello non compare più nel suo elenco di modelli. Il test è durato dal 20 agosto fino al lancio di GLM-5.3-Flash da parte di Z.ai il 26 agosto. Poiché il listing è stato rimosso, il prezzo durante il test non si può più verificare né su OpenRouter né su Z.ai.

GLM-5.3-Flash ora è un modello a pagamento. La pagina dei prezzi di Z.ai lo indica a $0,15 per milione di token di input, $0,03 per milione di token di input in cache e $0,50 per milione di token di output. OpenRouter indica le stesse tariffe di input e output per z-ai/glm-5.3-flash. I prezzi cambiano, quindi controlla entrambe le pagine prima di impegnarti.

Come uso Ox Alpha adesso?

Chiama GLM-5.3-Flash con il suo vero nome. Ci sono tre modi:

  1. L'API di Z.ai, con il codice modello glm-5.3-flash.
  2. OpenRouter, con l'ID modello z-ai/glm-5.3-flash.
  3. OpenCode, dove il modello ora compare come GLM-5.3-Flash.

Gli agenti di coding che ti permettono di impostare un base URL e un nome di modello possono usarlo tramite entrambe le API. Z.ai ha rilasciato anche una variante più recente, GLM-5.3-FlashX; il suo codice modello è glm-5.3-flashx.

Posso eseguire Ox Alpha in locale?

I pesi sono pubblici. Il post di lancio di Z.ai dice: "I pesi del modello GLM-5.3-Flash sono disponibili pubblicamente su Hugging Face." La model card indica la licenza MIT. Con 320 miliardi di parametri in totale, eseguirlo richiede hardware da data center con più GPU, anche se per ogni token ne sono attivi solo 18 miliardi, quindi la maggior parte delle persone lo chiama tramite API.

I miei prompt sono stati conservati quando era un modello stealth?

La pagina di OpenRouter dice che prompt e completamenti di questo modello "sono stati conservati" dall'azienda che lo gestiva, Z.ai, e "non vengono usati per l'addestramento". Se hai inviato codice privato a Ox Alpha tramite OpenRouter, dai per scontato che Z.ai lo abbia conservato.

Quali sono le alternative a Ox Alpha per gli agenti di coding?

Se vuoi un modello per il coding da chiamare da Claude Code o Codex con una sola chiave e pagamento a consumo, questi modelli sono disponibili oggi su SeedRouter:

SeedRouter non offre GLM-5.3-Flash. Ricarichi una volta, senza abbonamento, i crediti non scadono mai e una richiesta che fallisce non viene addebitata. I prezzi aggiornati sono nella pagina di ogni modello.

Domande frequenti

Ox Alpha è GLM?

Sì. Ox Alpha era GLM-5.3-Flash di Z.ai. Z.ai lo ha confermato quando ha lanciato il modello il 26 agosto 2026, e ora lo dice anche la pagina di OpenRouter.

Ox Alpha è cinese?

È stato creato da Z.ai, che dice che tutto il traffico del periodo stealth è stato "servito su chip AI cinesi".

Ox Alpha è open source?

I suoi pesi sì. GLM-5.3-Flash è su Hugging Face con licenza MIT.

Perché Ox Alpha è sparito?

Perché il test è finito. Quando Z.ai ha lanciato GLM-5.3-Flash, il nome ox-alpha è stato ritirato e il modello è passato al suo vero nome.

Ox Alpha è meglio di Claude?

Z.ai riporta che GLM-5.3-Flash allo sforzo massimo "eguaglia quasi Claude Opus 4.8" sul suo Code Bench. È un solo benchmark, dello sviluppatore del modello, non un confronto indipendente.

Guide correlate