Czym jest Ox Alpha? Model stealth, który okazał się Z.ai GLM-5.3-Flash
Ox Alpha to anonimowa nazwa Z.ai GLM-5.3-Flash w OpenRouter i OpenCode. Kto go stworzył, specyfikacja, czy nadal jest za darmo i jak go teraz używać.
Czytaj jako MarkdownOx Alpha to anonimowa nazwa testowa GLM-5.3-Flash, modelu Z.ai do programowania i pracy agentów. Pojawił się w OpenRouter i OpenCode jako model „stealth” 20 sierpnia 2026 r., bez podanego twórcy. 26 sierpnia Z.ai wydało GLM-5.3-Flash i potwierdziło, że to był Ox Alpha. Nazwa ox-alpha już nie działa; aby dziś używać tego samego modelu, wywołuj GLM-5.3-Flash. Każdy fakt poniżej pochodzi od Z.ai, OpenRouter lub OpenCode i został sprawdzony 29 września 2026 r.
Kto stworzył Ox Alpha?
Z.ai. Wpis o premierze GLM-5.3-Flash mówi, że przed wydaniem firma „testowała GLM-5.3-Flash anonimowo jako ox-alpha w OpenCode i OpenRouter, aby zebrać opinie użytkowników”, i że „szybko stał się najpopularniejszym modelem tygodnia”.
Strona modelu w OpenRouter to potwierdza: „Ten model stealth został opracowany i był obsługiwany przez ZAI; ujawniono, że to ZAI GLM-5.3-Flash”. OpenCode wymienia teraz model jako GLM-5.3-Flash, „dawniej ox-alpha”.
Gdy model był anonimowy, zgadywano, że to Gemini, model GLM albo coś innego. Trop GLM był blisko, ale nie dokładnie: Ox Alpha to GLM-5.3-Flash, a nie GLM-5.3, który Z.ai wydało osobno jako model wyłącznie tekstowy.
Czym był „model stealth”?
To model, który laboratorium udostępnia na publicznej platformie pod nazwą kodową przed premierą, żeby zebrać realne użycie i opinie. OpenRouter hostuje takie modele z prefiksem stealth/; ID Ox Alpha brzmiało stealth/ox-alpha. Gdy laboratorium ogłasza model, OpenRouter ujawnia, kto go stworzył, i odsyła do prawdziwej nazwy modelu.
Jaka jest specyfikacja Ox Alpha?
To opublikowana specyfikacja GLM-5.3-Flash, modelu stojącego za Ox Alpha:
| Parametr | Wartość |
|---|---|
| Twórca | Z.ai |
| Premiera stealth | 20 sierpnia 2026 r., w OpenRouter i OpenCode |
| Oficjalna premiera | 26 sierpnia 2026 r., jako GLM-5.3-Flash |
| Parametry | 320B łącznie, 18B aktywnych |
| Architektura | „Hybrydowa architektura łącząca uwagę rzadką i liniową” |
| Okno kontekstu | 1 048 576 tokenów (1M) |
| Maks. wyjście | 128K tokenów |
| Wejście | Tekst, obrazy i wideo (dokumentacja Z.ai wymienia też pliki) |
| Wyjście | Tekst |
| Wagi | Publiczne na Hugging Face na licencji MIT |
| ID modelu | glm-5.3-flash w API Z.ai; z-ai/glm-5.3-flash w OpenRouter |
OpenRouter opisywał Ox Alpha jako „model z rozumowaniem zaprojektowany do programowania, długotrwałej pracy agentowej i obciążeń produkcyjnych”. Jak okno kontekstu i limit wyjścia działają razem, wyjaśnia tekst okno kontekstu a maksymalna liczba tokenów wyjściowych.
Jak dobry jest Ox Alpha?
Z.ai opublikowało to porównanie we wpisie o premierze GLM-5.3-Flash:
| Benchmark | GLM-5.3-Flash | GLM-5.2 | Claude Opus 4.8 | GPT-5.6 Terra | Gemini 3.7 Flash |
|---|---|---|---|---|---|
| Terminal Bench 2.1 | 84.3 | 81.0 | 85.0 | 87.4 | 85.8 |
| DeepSWE v1.1 | 63.4 | 46.2 | 58.0 | 69.6 | 65.3 |
| AutomationBench v1.0.6 | 48.8 | 26.2 | 41.0 | 37.2 | 52.3 |
Z.ai podsumowuje to jako „ogólnie zbliżony do Claude Opus 4.8”. Dodaje, że w wewnętrznym Z.ai Code Bench v1.0 model „przy maksymalnym poziomie rozumowania niemal dorównuje Claude Opus 4.8 (29.0 wobec 29.5)” i że w Artificial Analysis Intelligence Index v4.1.1 zdobywa 57 punktów „za jedyne $0,045 na zadanie (po rabacie)”.
To wyniki samego twórcy w benchmarkach, które sam wybrał. Zanim zaczniesz na nim polegać, sprawdź model na własnych zadaniach.
Czy Ox Alpha jest nadal za darmo?
Nie, a sama nazwa ox-alpha już nie istnieje. Pozycja stealth/ox-alpha w OpenRouter nie ma aktywnych endpointów, a model nie pojawia się już na liście modeli. Test trwał od 20 sierpnia do premiery GLM-5.3-Flash 26 sierpnia. Ponieważ pozycja zniknęła, ceny z okresu testu nie da się już sprawdzić ani w OpenRouter, ani w Z.ai.
GLM-5.3-Flash jest teraz modelem płatnym. Cennik Z.ai podaje $0,15 za milion tokenów wejściowych, $0,03 za milion tokenów wejściowych z cache i $0,50 za milion tokenów wyjściowych. OpenRouter podaje te same stawki za wejście i wyjście dla z-ai/glm-5.3-flash. Ceny się zmieniają, więc zanim się zdecydujesz, sprawdź obie strony.
Jak używać Ox Alpha teraz?
Wywołuj GLM-5.3-Flash pod jego prawdziwą nazwą. Są trzy sposoby:
- API Z.ai, z kodem modelu
glm-5.3-flash. - OpenRouter, z ID modelu
z-ai/glm-5.3-flash. - OpenCode, gdzie model występuje teraz jako GLM-5.3-Flash.
Agenty do kodowania, które pozwalają ustawić bazowy adres URL i nazwę modelu, mogą go używać przez każde z tych dwóch API. Z.ai wydało też nowszy wariant, GLM-5.3-FlashX; jego kod modelu to glm-5.3-flashx.
Czy mogę uruchomić Ox Alpha lokalnie?
Wagi są publiczne. Wpis Z.ai o premierze mówi: „Wagi modelu GLM-5.3-Flash są publicznie dostępne na Hugging Face”. Karta modelu podaje licencję MIT. Przy 320 miliardach parametrów łącznie jego uruchomienie wymaga sprzętu klasy centrum danych z wieloma GPU, mimo że na token aktywnych jest tylko 18 miliardów, dlatego większość osób wywołuje go przez API.
Czy moje prompty były przechowywane, gdy był modelem stealth?
Strona OpenRouter mówi, że prompty i odpowiedzi tego modelu „były przechowywane” przez firmę, która go obsługiwała, czyli Z.ai, i „nie są używane do trenowania”. Jeśli wysłałeś prywatny kod do Ox Alpha przez OpenRouter, przyjmij, że Z.ai go zachowało.
Jakie są alternatywy dla Ox Alpha dla agentów do kodowania?
Jeśli chcesz modelu do programowania, który wywołasz z Claude Code lub Codex jednym kluczem i z płatnością za użycie, te modele są dziś dostępne w SeedRouter:
- DeepSeek V4.1 Flash, szybki i tani model DeepSeek z kontekstem 1M tokenów. Konfiguracja: DeepSeek V4.1 Flash w Claude Code i Codex.
- Kimi K3, model Moonshot AI z otwartymi wagami do długich sesji programistycznych. Konfiguracja: Kimi K3 w Claude Code i Codex.
- GPT-6, czyli GPT-6 Astra, Sol i Luna od OpenAI. Konfiguracja: GPT-6 w Codex.
SeedRouter nie udostępnia GLM-5.3-Flash. Doładowujesz raz, bez subskrypcji, kredyty nigdy nie wygasają, a nieudane żądanie nie jest rozliczane. Aktualne ceny są na stronie każdego modelu.
Najczęściej zadawane pytania
Czy Ox Alpha to GLM?
Tak. Ox Alpha to był GLM-5.3-Flash od Z.ai. Z.ai potwierdziło to przy premierze modelu 26 sierpnia 2026 r., a strona OpenRouter mówi teraz to samo.
Czy Ox Alpha jest chiński?
Stworzyło go Z.ai, które podaje, że cały ruch w teście stealth był „obsługiwany na chińskich chipach AI”.
Czy Ox Alpha jest open source?
Jego wagi tak. GLM-5.3-Flash jest na Hugging Face na licencji MIT.
Dlaczego Ox Alpha zniknął?
Bo test się skończył. Gdy Z.ai wydało GLM-5.3-Flash, nazwę ox-alpha wycofano, a model przeszedł na swoją prawdziwą nazwę.
Czy Ox Alpha jest lepszy od Claude?
Z.ai podaje, że GLM-5.3-Flash przy maksymalnym poziomie rozumowania „niemal dorównuje Claude Opus 4.8” we własnym Code Bench. To jeden benchmark od twórcy modelu, a nie niezależne porównanie.



