Was ist Ox Alpha? Das Stealth-Modell, hinter dem Z.ai GLM-5.3-Flash steckt
Ox Alpha war der anonyme Name von Z.ai GLM-5.3-Flash auf OpenRouter und OpenCode. Wer es gebaut hat, Specs, ob es noch gratis ist und wie Sie es jetzt nutzen.
Als Markdown lesenOx Alpha war der anonyme Testname von GLM-5.3-Flash, einem Coding- und Agent-Modell von Z.ai. Es erschien am 20. August 2026 als „Stealth“-Modell auf OpenRouter und OpenCode, ohne dass ein Hersteller genannt wurde. Am 26. August veröffentlichte Z.ai GLM-5.3-Flash und bestätigte, dass es sich um Ox Alpha handelte. Der Name ox-alpha funktioniert nicht mehr; um dasselbe Modell heute zu nutzen, rufen Sie GLM-5.3-Flash auf. Jede Angabe unten stammt von Z.ai, OpenRouter oder OpenCode, geprüft am 29. September 2026.
Wer hat Ox Alpha entwickelt?
Z.ai. Der Launch-Beitrag zu GLM-5.3-Flash sagt, das Unternehmen habe vor der Veröffentlichung „GLM-5.3-Flash anonym als ox-alpha auf OpenCode und OpenRouter getestet, um Nutzerfeedback zu sammeln“, und „es wurde schnell zum beliebtesten Modell der Woche“.
OpenRouters Seite für das Modell bestätigt das: „Dieses Stealth-Modell wurde von ZAI entwickelt und betrieben und hat sich als ZAI GLM-5.3-Flash herausgestellt.“ OpenCode listet das Modell jetzt als GLM-5.3-Flash, „früher ox-alpha“.
Solange es anonym war, tippten Nutzer auf Gemini, ein GLM-Modell und andere. Der GLM-Tipp lag nah dran, aber nicht genau: Ox Alpha ist GLM-5.3-Flash, nicht GLM-5.3, das Z.ai separat als reines Textmodell veröffentlicht hat.
Was war ein „Stealth-Modell“?
Ein Modell, das ein Labor vor dem Launch unter einem Codenamen auf eine öffentliche Plattform stellt, um echte Nutzung und Feedback zu sammeln. OpenRouter führt solche Modelle unter dem Präfix stealth/; die ID von Ox Alpha war stealth/ox-alpha. Wenn das Labor das Modell ankündigt, gibt OpenRouter den Hersteller bekannt und verweist auf den echten Namen des Modells.
Welche Specs hat Ox Alpha?
Das sind die veröffentlichten Specs von GLM-5.3-Flash, dem Modell hinter Ox Alpha:
| Spec | Wert |
|---|---|
| Entwickler | Z.ai |
| Stealth-Veröffentlichung | 20. August 2026, auf OpenRouter und OpenCode |
| Offizielle Veröffentlichung | 26. August 2026, als GLM-5.3-Flash |
| Parameter | 320B gesamt, 18B aktiv |
| Architektur | „Eine hybride Architektur, die Sparse Attention und lineare Attention kombiniert“ |
| Kontextfenster | 1.048.576 Token (1M) |
| Maximale Ausgabe | 128K Token |
| Eingabe | Text, Bilder und Video (Z.ais Dokumentation nennt außerdem Dateien) |
| Ausgabe | Text |
| Gewichte | Öffentlich auf Hugging Face unter der MIT-Lizenz |
| Modell-ID | glm-5.3-flash in Z.ais API; z-ai/glm-5.3-flash auf OpenRouter |
OpenRouter beschrieb Ox Alpha als „ein Reasoning-Modell für Coding, anhaltende agentische Arbeit und produktive Workloads“. Wie Kontextfenster und Ausgabelimit zusammenspielen, lesen Sie unter Kontextfenster vs. maximale Ausgabe-Token.
Wie gut ist Ox Alpha?
Z.ai hat diesen Vergleich in seinem Launch-Beitrag zu GLM-5.3-Flash veröffentlicht:
| Benchmark | GLM-5.3-Flash | GLM-5.2 | Claude Opus 4.8 | GPT-5.6 Terra | Gemini 3.7 Flash |
|---|---|---|---|---|---|
| Terminal Bench 2.1 | 84.3 | 81.0 | 85.0 | 87.4 | 85.8 |
| DeepSWE v1.1 | 63.4 | 46.2 | 58.0 | 69.6 | 65.3 |
| AutomationBench v1.0.6 | 48.8 | 26.2 | 41.0 | 37.2 | 52.3 |
Z.ai fasst es als „insgesamt nahe an Claude Opus 4.8“ zusammen. Es ergänzt, dass das Modell auf seinem hauseigenen Z.ai Code Bench v1.0 „bei maximalem Aufwand fast mit Claude Opus 4.8 gleichzieht (29.0 vs. 29.5)“ und im Artificial Analysis Intelligence Index v4.1.1 57 Punkte erreicht, „für nur $0,045 pro Aufgabe (rabattiert)“.
Das sind die eigenen Ergebnisse des Entwicklers auf Benchmarks, die er selbst ausgewählt hat. Testen Sie das Modell mit Ihren eigenen Aufgaben, bevor Sie sich darauf verlassen.
Ist Ox Alpha noch kostenlos?
Nein, und den Namen ox-alpha selbst gibt es nicht mehr. OpenRouters Eintrag stealth/ox-alpha hat keine aktiven Endpunkte, und das Modell erscheint nicht mehr in der Modellliste. Der Test lief vom 20. August, bis Z.ai GLM-5.3-Flash am 26. August startete. Da der Eintrag verschwunden ist, lässt sich der Preis während des Tests weder bei OpenRouter noch bei Z.ai mehr prüfen.
GLM-5.3-Flash ist jetzt ein kostenpflichtiges Modell. Z.ais Preisseite nennt $0,15 pro Million Eingabe-Token, $0,03 pro Million gecachter Eingabe-Token und $0,50 pro Million Ausgabe-Token. OpenRouter nennt dieselben Eingabe- und Ausgabetarife für z-ai/glm-5.3-flash. Preise ändern sich, prüfen Sie also beide Seiten, bevor Sie sich festlegen.
Wie nutze ich Ox Alpha jetzt?
Rufen Sie GLM-5.3-Flash unter seinem echten Namen auf. Es gibt drei Wege:
- Z.ais API, mit dem Modellcode
glm-5.3-flash. - OpenRouter, mit der Modell-ID
z-ai/glm-5.3-flash. - OpenCode, wo das Modell jetzt als GLM-5.3-Flash erscheint.
Coding-Agenten, bei denen Sie eine Base-URL und einen Modellnamen setzen können, nutzen es über beide APIs. Z.ai hat außerdem eine neuere Variante veröffentlicht, GLM-5.3-FlashX; ihr Modellcode ist glm-5.3-flashx.
Kann ich Ox Alpha lokal ausführen?
Die Gewichte sind öffentlich. Z.ais Launch-Beitrag sagt: „Die Modellgewichte von GLM-5.3-Flash sind auf Hugging Face öffentlich verfügbar.“ Die Model Card nennt die MIT-Lizenz. Mit insgesamt 320 Milliarden Parametern braucht der Betrieb Multi-GPU-Hardware auf Rechenzentrumsniveau, auch wenn pro Token nur 18 Milliarden aktiv sind, daher rufen die meisten das Modell über eine API auf.
Wurden meine Prompts gespeichert, als es ein Stealth-Modell war?
OpenRouters Seite sagt, dass Prompts und Antworten für dieses Modell vom Unternehmen, das es betrieb, Z.ai, „aufbewahrt wurden“ und „nicht für das Training verwendet werden“. Wenn Sie über OpenRouter privaten Code an Ox Alpha gesendet haben, gehen Sie davon aus, dass Z.ai ihn aufbewahrt hat.
Welche Alternativen zu Ox Alpha gibt es für Coding-Agenten?
Wenn Sie ein Coding-Modell wollen, das Sie aus Claude Code oder Codex mit einem Key und nutzungsbasierter Abrechnung aufrufen können, sind diese Modelle heute bei SeedRouter verfügbar:
- DeepSeek V4.1 Flash, DeepSeeks schnelles, günstiges Modell mit 1M Token Kontext. Einrichtung: DeepSeek V4.1 Flash in Claude Code und Codex.
- Kimi K3, das Open-Weight-Modell von Moonshot AI für lange Coding-Sitzungen. Einrichtung: Kimi K3 in Claude Code und Codex.
- GPT-6, OpenAIs GPT-6 Astra, Sol und Luna. Einrichtung: GPT-6 in Codex.
SeedRouter bietet GLM-5.3-Flash nicht an. Sie laden einmal auf, ohne Abo, Guthaben verfällt nie, und eine fehlgeschlagene Anfrage wird nicht berechnet. Aktuelle Preise stehen auf jeder Modellseite.
Häufig gestellte Fragen
Ist Ox Alpha GLM?
Ja. Ox Alpha war Z.ais GLM-5.3-Flash. Z.ai bestätigte das beim Launch des Modells am 26. August 2026, und OpenRouters Seite sagt inzwischen dasselbe.
Ist Ox Alpha chinesisch?
Es wurde von Z.ai entwickelt, das angibt, der gesamte Stealth-Traffic sei „auf chinesischen KI-Chips bedient“ worden.
Ist Ox Alpha Open Source?
Seine Gewichte schon. GLM-5.3-Flash liegt auf Hugging Face unter der MIT-Lizenz.
Warum ist Ox Alpha verschwunden?
Weil der Test zu Ende war. Als Z.ai GLM-5.3-Flash startete, wurde der Name ox-alpha eingestellt, und das Modell wechselte zu seinem echten Namen.
Ist Ox Alpha besser als Claude?
Z.ai berichtet, dass GLM-5.3-Flash bei maximalem Aufwand auf seinem eigenen Code Bench „fast mit Claude Opus 4.8 gleichzieht“. Das ist ein einzelner Benchmark vom Entwickler des Modells, kein unabhängiger Vergleich.



