Ox Alpha란? 정체가 밝혀진 스텔스 모델, Z.ai GLM-5.3-Flash
Ox Alpha는 OpenRouter와 OpenCode에 익명으로 올라온 Z.ai GLM-5.3-Flash였습니다. 개발사, 스펙, 지금도 무료인지, 지금 쓰는 방법을 정리했습니다.
Markdown으로 읽기Ox Alpha는 Z.ai의 코딩·에이전트 모델인 GLM-5.3-Flash의 익명 테스트 이름이었습니다. 2026년 8월 20일, 개발사를 밝히지 않은 "스텔스" 모델로 OpenRouter와 OpenCode에 등장했습니다. 8월 26일 Z.ai가 GLM-5.3-Flash를 출시하면서 이 모델이 Ox Alpha였다고 확인했습니다. ox-alpha라는 이름은 이제 작동하지 않으며, 같은 모델을 지금 쓰려면 GLM-5.3-Flash를 호출하면 됩니다. 아래의 모든 사실은 Z.ai, OpenRouter 또는 OpenCode에서 가져왔으며, 2026년 9월 29일에 확인했습니다.
Ox Alpha는 누가 만들었나요?
Z.ai입니다. GLM-5.3-Flash 출시 글에서 이 회사는 출시 전에 "사용자 피드백을 모으기 위해 GLM-5.3-Flash를 OpenCode와 OpenRouter에서 ox-alpha라는 이름으로 익명 테스트했다"고 밝혔고, "순식간에 그 주에 가장 인기 있는 모델이 되었다"고 덧붙였습니다.
OpenRouter의 모델 페이지도 이를 확인합니다. "이 스텔스 모델은 ZAI가 개발하고 운영했으며, ZAI GLM-5.3-Flash로 밝혀졌습니다." OpenCode는 이제 이 모델을 GLM-5.3-Flash로 표시하고 "이전 이름 ox-alpha"라고 적어 두었습니다.
익명이던 동안 사람들은 Gemini, GLM 모델 등 여러 후보를 추측했습니다. GLM이라는 추측은 가까웠지만 정확하지는 않았습니다. Ox Alpha는 GLM-5.3이 아니라 GLM-5.3-Flash이며, GLM-5.3은 Z.ai가 텍스트 전용 모델로 따로 출시했습니다.
"스텔스 모델"이란 무엇이었나요?
AI 연구소가 출시 전에 실제 사용 데이터와 피드백을 모으려고 코드명을 붙여 공개 플랫폼에 올리는 모델입니다. OpenRouter는 이런 모델을 stealth/ 접두사 아래에 두며, Ox Alpha의 ID는 stealth/ox-alpha였습니다. 연구소가 모델을 발표하면 OpenRouter가 개발사를 공개하고 모델의 실제 이름을 안내합니다.
Ox Alpha의 스펙은 어떤가요?
아래는 Ox Alpha의 실제 모델인 GLM-5.3-Flash의 공개 스펙입니다.
| 항목 | 값 |
|---|---|
| 개발사 | Z.ai |
| 스텔스 공개 | 2026년 8월 20일, OpenRouter와 OpenCode |
| 정식 출시 | 2026년 8월 26일, GLM-5.3-Flash로 |
| 파라미터 | 총 320B, 활성 18B |
| 아키텍처 | "희소 어텐션과 선형 어텐션을 결합한 하이브리드 아키텍처" |
| 컨텍스트 윈도우 | 1,048,576 토큰 (1M) |
| 최대 출력 | 128K 토큰 |
| 입력 | 텍스트, 이미지, 동영상 (Z.ai 문서에는 파일도 나와 있음) |
| 출력 | 텍스트 |
| 가중치 | MIT 라이선스로 Hugging Face에 공개 |
| 모델 ID | Z.ai API에서는 glm-5.3-flash, OpenRouter에서는 z-ai/glm-5.3-flash |
OpenRouter는 Ox Alpha를 "코딩, 장시간 이어지는 에이전트 작업, 프로덕션 워크로드를 위해 설계된 추론 모델"이라고 소개했습니다. 컨텍스트 윈도우와 출력 한도가 어떻게 함께 작동하는지는 컨텍스트 윈도우와 최대 출력 토큰의 차이를 참고하세요.
Ox Alpha의 성능은 어느 정도인가요?
Z.ai는 GLM-5.3-Flash 출시 글에서 다음 비교표를 공개했습니다.
| 벤치마크 | GLM-5.3-Flash | GLM-5.2 | Claude Opus 4.8 | GPT-5.6 Terra | Gemini 3.7 Flash |
|---|---|---|---|---|---|
| Terminal Bench 2.1 | 84.3 | 81.0 | 85.0 | 87.4 | 85.8 |
| DeepSWE v1.1 | 63.4 | 46.2 | 58.0 | 69.6 | 65.3 |
| AutomationBench v1.0.6 | 48.8 | 26.2 | 41.0 | 37.2 | 52.3 |
Z.ai는 이를 "전반적으로 Claude Opus 4.8에 근접한다"고 요약합니다. 또한 자체 벤치마크인 Z.ai Code Bench v1.0에서 이 모델이 "최대 추론 강도에서 Claude Opus 4.8과 거의 대등하다(29.0 대 29.5)"고 하며, Artificial Analysis Intelligence Index v4.1.1에서 "작업당 단 $0.045(할인가)로" 57점을 받았다고 밝힙니다.
이 결과는 개발사가 직접 고른 벤치마크에서 스스로 측정한 것입니다. 실제로 의존하기 전에 여러분의 작업으로 직접 테스트해 보세요.
Ox Alpha는 지금도 무료인가요?
아니요. ox-alpha라는 이름 자체가 사라졌습니다. OpenRouter의 stealth/ox-alpha 항목에는 활성 엔드포인트가 없고, 모델 목록에서도 더 이상 보이지 않습니다. 테스트는 8월 20일부터 Z.ai가 GLM-5.3-Flash를 출시한 8월 26일까지 진행됐습니다. 항목이 없어졌기 때문에 테스트 기간의 가격은 이제 OpenRouter나 Z.ai에서 확인할 수 없습니다.
GLM-5.3-Flash는 현재 유료 모델입니다. Z.ai 요금 페이지에 따르면 입력은 100만 토큰당 $0.15, 캐시된 입력은 100만 토큰당 $0.03, 출력은 100만 토큰당 $0.50입니다. OpenRouter도 z-ai/glm-5.3-flash에 같은 입력·출력 요금을 표시합니다. 가격은 바뀔 수 있으니 결정하기 전에 두 페이지를 모두 확인하세요.
지금 Ox Alpha를 쓰려면 어떻게 하나요?
실제 이름인 GLM-5.3-Flash로 호출하면 됩니다. 방법은 세 가지입니다.
- Z.ai API: 모델 코드
glm-5.3-flash를 사용합니다. - OpenRouter: 모델 ID
z-ai/glm-5.3-flash를 사용합니다. - OpenCode: 이제 모델이 GLM-5.3-Flash로 표시됩니다.
베이스 URL과 모델 이름을 지정할 수 있는 코딩 에이전트라면 두 API 중 어느 쪽으로든 사용할 수 있습니다. Z.ai는 더 새로운 변형인 GLM-5.3-FlashX도 출시했으며, 모델 코드는 glm-5.3-flashx입니다.
Ox Alpha를 로컬에서 실행할 수 있나요?
가중치는 공개되어 있습니다. Z.ai 출시 글에는 "GLM-5.3-Flash의 모델 가중치는 Hugging Face에 공개되어 있다"고 적혀 있고, 모델 카드에는 MIT 라이선스가 명시되어 있습니다. 토큰마다 활성화되는 파라미터는 180억 개뿐이지만 전체가 3,200억 개이므로, 실행하려면 멀티 GPU 데이터센터급 하드웨어가 필요합니다. 그래서 대부분은 API로 호출합니다.
스텔스 모델이던 시절 보낸 프롬프트는 저장됐나요?
OpenRouter 페이지에 따르면 이 모델의 프롬프트와 응답은 모델을 운영한 회사인 Z.ai가 "보관했으며" "학습에는 사용하지 않는다"고 합니다. OpenRouter를 통해 Ox Alpha에 비공개 코드를 보냈다면 Z.ai가 이를 보관하고 있다고 가정하세요.
코딩 에이전트용 Ox Alpha 대안은 무엇인가요?
키 하나와 종량제 결제로 Claude Code나 Codex에서 호출할 수 있는 코딩 모델을 찾는다면, 지금 SeedRouter에서 바로 쓸 수 있는 모델은 다음과 같습니다.
- DeepSeek V4.1 Flash: 1M 토큰 컨텍스트를 갖춘 DeepSeek의 빠르고 저렴한 모델입니다. 설정: Claude Code와 Codex에서 DeepSeek V4.1 Flash 쓰기.
- Kimi K3: 긴 코딩 세션을 위한 Moonshot AI의 오픈 웨이트 모델입니다. 설정: Claude Code와 Codex에서 Kimi K3 쓰기.
- GPT-6: OpenAI의 GPT-6 Astra, Sol, Luna입니다. 설정: Codex에서 GPT-6 쓰기.
SeedRouter는 GLM-5.3-Flash를 제공하지 않습니다. 구독 없이 한 번 충전하면 되고, 크레딧은 만료되지 않으며, 실패한 요청에는 요금이 부과되지 않습니다. 실시간 요금은 각 모델 페이지에 있습니다.
자주 묻는 질문
Ox Alpha는 GLM인가요?
네. Ox Alpha는 Z.ai의 GLM-5.3-Flash였습니다. Z.ai가 2026년 8월 26일 모델을 출시하면서 이를 확인했고, OpenRouter 페이지에도 지금 같은 내용이 나와 있습니다.
Ox Alpha는 중국 모델인가요?
Z.ai가 만들었으며, Z.ai는 스텔스 기간의 트래픽이 모두 "중국산 AI 칩에서 처리되었다"고 밝힙니다.
Ox Alpha는 오픈소스인가요?
가중치는 공개되어 있습니다. GLM-5.3-Flash는 MIT 라이선스로 Hugging Face에 올라와 있습니다.
Ox Alpha는 왜 사라졌나요?
테스트가 끝났기 때문입니다. Z.ai가 GLM-5.3-Flash를 출시하면서 ox-alpha라는 이름은 폐기되었고, 모델은 실제 이름으로 옮겨졌습니다.
Ox Alpha가 Claude보다 좋은가요?
Z.ai는 GLM-5.3-Flash가 최대 추론 강도에서 자체 Code Bench 기준 "Claude Opus 4.8과 거의 대등하다"고 발표했습니다. 이는 모델 개발사가 내놓은 벤치마크 하나일 뿐, 독립적인 비교가 아닙니다.



