Cos'è Ox Alpha? Il modello stealth rivelato come GLM-5.3-Flash di Z.ai
Ox Alpha era il nome anonimo di GLM-5.3-Flash di Z.ai su OpenRouter e OpenCode. Chi l'ha creato, le specifiche, se è ancora gratis e come usarlo ora.
Leggi in MarkdownOx Alpha era il nome di test anonimo di GLM-5.3-Flash, un modello di Z.ai per il coding e gli agenti. È comparso su OpenRouter e OpenCode come modello "stealth" il 20 agosto 2026, senza che fosse indicato chi l'avesse creato. Il 26 agosto Z.ai ha rilasciato GLM-5.3-Flash e ha confermato che si trattava di Ox Alpha. Il nome ox-alpha non funziona più; per usare lo stesso modello oggi, chiama GLM-5.3-Flash. Ogni informazione qui sotto viene da Z.ai, OpenRouter o OpenCode, verificata il 29 settembre 2026.
Chi ha creato Ox Alpha?
Z.ai. Il post di lancio di GLM-5.3-Flash dice che prima del rilascio l'azienda "ha testato GLM-5.3-Flash in forma anonima come ox-alpha su OpenCode e OpenRouter per raccogliere il feedback degli utenti", e che "è diventato rapidamente il modello più popolare della settimana".
La pagina del modello su OpenRouter lo conferma: "Questo modello stealth è stato sviluppato e gestito da ZAI, e si è rivelato essere ZAI GLM-5.3-Flash." OpenCode ora elenca il modello come GLM-5.3-Flash, "Formerly ox-alpha" (cioè "in precedenza ox-alpha").
Mentre era anonimo, si ipotizzava che fosse Gemini, un modello GLM o altro. L'ipotesi GLM era vicina ma non esatta: Ox Alpha è GLM-5.3-Flash, non GLM-5.3, che Z.ai ha rilasciato separatamente come modello solo testo.
Cos'era un "modello stealth"?
Un modello che un laboratorio pubblica su una piattaforma aperta con un nome in codice prima del lancio, per raccogliere utilizzo reale e feedback. OpenRouter ospita questi modelli con il prefisso stealth/; l'ID di Ox Alpha era stealth/ox-alpha. Quando il laboratorio annuncia il modello, OpenRouter rivela chi l'ha creato e rimanda al suo vero nome.
Quali sono le specifiche di Ox Alpha?
Queste sono le specifiche pubblicate di GLM-5.3-Flash, il modello dietro Ox Alpha:
| Specifica | Valore |
|---|---|
| Sviluppatore | Z.ai |
| Rilascio stealth | 20 agosto 2026, su OpenRouter e OpenCode |
| Rilascio ufficiale | 26 agosto 2026, come GLM-5.3-Flash |
| Parametri | 320 miliardi in totale, 18 miliardi attivi |
| Architettura | "Un'architettura ibrida che combina attenzione sparsa e lineare" |
| Finestra di contesto | 1.048.576 token (1M) |
| Output massimo | 128K token |
| Input | Testo, immagini e video (la documentazione di Z.ai elenca anche i file) |
| Output | Testo |
| Pesi | Pubblici su Hugging Face con licenza MIT |
| ID modello | glm-5.3-flash sull'API di Z.ai; z-ai/glm-5.3-flash su OpenRouter |
OpenRouter descriveva Ox Alpha come "un modello di ragionamento progettato per il coding, il lavoro agentico prolungato e i carichi di lavoro in produzione." Per capire come funzionano insieme la finestra di contesto e il limite di output, leggi Finestra di contesto e token di output massimi.
Quanto è bravo Ox Alpha?
Z.ai ha pubblicato questo confronto nel post di lancio di GLM-5.3-Flash:
| Benchmark | GLM-5.3-Flash | GLM-5.2 | Claude Opus 4.8 | GPT-5.6 Terra | Gemini 3.7 Flash |
|---|---|---|---|---|---|
| Terminal Bench 2.1 | 84.3 | 81.0 | 85.0 | 87.4 | 85.8 |
| DeepSWE v1.1 | 63.4 | 46.2 | 58.0 | 69.6 | 65.3 |
| AutomationBench v1.0.6 | 48.8 | 26.2 | 41.0 | 37.2 | 52.3 |
Z.ai lo riassume così: "si avvicina a Claude Opus 4.8 nel complesso". Aggiunge che sul suo benchmark interno Z.ai Code Bench v1.0 il modello "allo sforzo massimo eguaglia quasi Claude Opus 4.8 (29.0 contro 29.5)", e che ottiene 57 sull'Artificial Analysis Intelligence Index v4.1.1 "a soli $0,045 per task (scontato)".
Sono risultati dello sviluppatore stesso, su benchmark scelti da lui. Prova il modello sui tuoi compiti prima di farci affidamento.
Ox Alpha è ancora gratis?
No, e il nome ox-alpha stesso non esiste più. Il listing stealth/ox-alpha su OpenRouter non ha endpoint attivi, e il modello non compare più nel suo elenco di modelli. Il test è durato dal 20 agosto fino al lancio di GLM-5.3-Flash da parte di Z.ai il 26 agosto. Poiché il listing è stato rimosso, il prezzo durante il test non si può più verificare né su OpenRouter né su Z.ai.
GLM-5.3-Flash ora è un modello a pagamento. La pagina dei prezzi di Z.ai lo indica a $0,15 per milione di token di input, $0,03 per milione di token di input in cache e $0,50 per milione di token di output. OpenRouter indica le stesse tariffe di input e output per z-ai/glm-5.3-flash. I prezzi cambiano, quindi controlla entrambe le pagine prima di impegnarti.
Come uso Ox Alpha adesso?
Chiama GLM-5.3-Flash con il suo vero nome. Ci sono tre modi:
- L'API di Z.ai, con il codice modello
glm-5.3-flash. - OpenRouter, con l'ID modello
z-ai/glm-5.3-flash. - OpenCode, dove il modello ora compare come GLM-5.3-Flash.
Gli agenti di coding che ti permettono di impostare un base URL e un nome di modello possono usarlo tramite entrambe le API. Z.ai ha rilasciato anche una variante più recente, GLM-5.3-FlashX; il suo codice modello è glm-5.3-flashx.
Posso eseguire Ox Alpha in locale?
I pesi sono pubblici. Il post di lancio di Z.ai dice: "I pesi del modello GLM-5.3-Flash sono disponibili pubblicamente su Hugging Face." La model card indica la licenza MIT. Con 320 miliardi di parametri in totale, eseguirlo richiede hardware da data center con più GPU, anche se per ogni token ne sono attivi solo 18 miliardi, quindi la maggior parte delle persone lo chiama tramite API.
I miei prompt sono stati conservati quando era un modello stealth?
La pagina di OpenRouter dice che prompt e completamenti di questo modello "sono stati conservati" dall'azienda che lo gestiva, Z.ai, e "non vengono usati per l'addestramento". Se hai inviato codice privato a Ox Alpha tramite OpenRouter, dai per scontato che Z.ai lo abbia conservato.
Quali sono le alternative a Ox Alpha per gli agenti di coding?
Se vuoi un modello per il coding da chiamare da Claude Code o Codex con una sola chiave e pagamento a consumo, questi modelli sono disponibili oggi su SeedRouter:
- DeepSeek V4.1 Flash, il modello veloce ed economico di DeepSeek con una finestra di contesto da 1M token. Configurazione: Usare DeepSeek V4.1 Flash in Claude Code e Codex.
- Kimi K3, il modello open-weight di Moonshot AI per lunghe sessioni di coding. Configurazione: Usare Kimi K3 in Claude Code e Codex.
- GPT-6, GPT-6 Astra, Sol e Luna di OpenAI. Configurazione: GPT-6 in Codex.
SeedRouter non offre GLM-5.3-Flash. Ricarichi una volta, senza abbonamento, i crediti non scadono mai e una richiesta che fallisce non viene addebitata. I prezzi aggiornati sono nella pagina di ogni modello.
Domande frequenti
Ox Alpha è GLM?
Sì. Ox Alpha era GLM-5.3-Flash di Z.ai. Z.ai lo ha confermato quando ha lanciato il modello il 26 agosto 2026, e ora lo dice anche la pagina di OpenRouter.
Ox Alpha è cinese?
È stato creato da Z.ai, che dice che tutto il traffico del periodo stealth è stato "servito su chip AI cinesi".
Ox Alpha è open source?
I suoi pesi sì. GLM-5.3-Flash è su Hugging Face con licenza MIT.
Perché Ox Alpha è sparito?
Perché il test è finito. Quando Z.ai ha lanciato GLM-5.3-Flash, il nome ox-alpha è stato ritirato e il modello è passato al suo vero nome.
Ox Alpha è meglio di Claude?
Z.ai riporta che GLM-5.3-Flash allo sforzo massimo "eguaglia quasi Claude Opus 4.8" sul suo Code Bench. È un solo benchmark, dello sviluppatore del modello, non un confronto indipendente.



