一、來歷不明的挑戰者
2026年8月20日,一個沒有署名、沒有公司標誌、甚至沒有正式文件說明的模型,悄然出現在第三方 AI 模型平台 OpenRouter 之上。它的代號是 stealth/ox-alpha——「匿名的 Ox Alpha」。免費、脈絡長度(context window)達 1,048,576 個 token、單次輸出上限 131,072 個 token,並原生支援文字、圖像與影片輸入。[3][10]
OpenRouter 在官方模型頁上刻意劃清界線:這是「由選擇在預覽期間維持匿名的第三方開發並營運」的模型,OpenRouter 僅負責轉發請求,並非其開發者、擁有者或供應商。[3] 同一模型亦以「Ox Alpha Free」之名登陸開源程式設計代理工具 OpenCode,標明限時免費。[3][6]
二、三天攻陷排行榜
免費加上強勁的實測表現,令 Ox Alpha 以驚人速度擴散。據統計,其每日請求量在三日內由 2,700 萬次飆升至 7,030 萬次;[4]截至 8 月 22 日已攀升至 OpenRouter 週用量榜第四位,單週處理 6.54 兆個 token,趨勢欄標記為「new」。[3] 內地社群更指其調用量達 DeepSeek 的兩倍以上,[9]並一度與 DeepSeek 並列排行榜首位;[7]在程式設計實測中,Ox Alpha 的 SWE 評測得分達到 80%。[9] The Rundown 將之形容為「AI 前沿的神秘挑戰者」。[11]
最耐人尋味的是,這一切都在完全匿名的情況下發生。正當全球開發者議論紛紛之際,Stripe 行政總裁 Patrick Collison 公開表示,試用 Ox Alpha 的結果「非常令人印象深刻」——而 Stripe 正正就是剛剛宣布收購 OpenRouter 的公司。[3]
三、身份爭奪戰:從 Gemini 到 GLM
一時間,網路社群化身偵探,掀起一場跨國猜測遊戲。[5] 有人從推理風格猜測它出自 Google Gemini;有人懷疑是微軟尚未發布的 MAI 模型。[3] 開發者 unclecode 開源了指紋比對工具 modelprint,透過 9 項基礎設施探針(包括 tokenizer 行為、錯誤訊息結構、finish_reason 字彙等)測試 Ox Alpha 的身份:結果顯示其與智譜(Z.ai)GLM-5.3 的比對為 9 項中 6 項吻合,tokenizer 4 組全中;而 OpenAI 的 GPT-5.6-luna 僅 2 項吻合、tokenizer 2 組。在所有候選實驗室中,只有 GLM 家族取得 tokenizer 4 組全中的成績。[3]
事實上,「匿名上架、事後認領」已成為中國 AI 實驗室的慣用策略。此前 OpenRouter 便曾揭曉,另一款匿名預覽模型 Pony Alpha 實為智譜的 GLM-5(744B 參數);小米的 MiMo-V2-Pro、螞蟻集團的 Lingxi、美團的 LongCat 亦先後循同一模式登場。[3][2] 不過 unclecode 亦審慎提醒:「相同的指紋只能證明共用同一套基礎設施,不能證明是同一個身份。」[3]
四、謎底揭曉:GLM-5.3-Flash
8 月 26 日,彭博社率先報導,智譜(Z.AI)官方證實:Ox Alpha 正是其 GLM 系列最新迭代的匿名預覽版本,並宣布於當晚開放模型權重。[1][6] 智譜在官方博客中形容 Ox Alpha 是「專為程式設計、持續性代理工作與正式環境負載而設計的推理模型」,適用於長時程軟體工程、複雜推理,以及結合文字與視覺脈絡的工作流。[1]
真正的身份是 GLM-5.3-Flash:一款 320B 總參數、18B 活躍參數(320B-A18B)的混合專家(MoE)模型,共 45 層,是 GLM-5 系列首款原生多模態模型,脈絡長度達 100 萬 token,可同時接收文字、圖像與影片輸入。[2] 智譜稱其為首個採用「混合稀疏注意力+線性注意力」設計的開源前沿模型,並搭配流形約束超連接(mHC)與 IndexPool 機制壓縮長脈絡延遲;預訓練語料達 30 兆 token。官方聲稱,相對於 GLM-5.3,注意力計算成本下降 3.0 倍、KV 快取下降 4.4 倍。[2]
五、性價比革命:十分之一的價格
GLM-5.3-Flash 最震撼之處在於定價:每百萬 input/output token 分別為 0.15 美元與 0.5 美元,快取輸入僅 0.03 美元;開幕優惠至 9 月 9 日再減半,即 0.075/0.25/0.015 美元。[2] 相對於旗艦 GLM-5.3 的每百萬 1.40/4.40 美元,新模型定價約為其十分之一;[2]智譜更宣稱其每次任務成本約 0.045 美元,僅為 Claude Opus 4.8 的四十分之一。[2] 發布材料中,官方對比對象涵蓋 Claude Opus 4.8 與 GPT-5.6 Terra 等頂級閉源模型。[8]
效能方面,智譜於發布材料中聲稱其人工分析智能指數(AA Intelligence Index)得分為 57,與 Claude Opus 4.8 同級;程式設計能力亦與 Opus 4.8 看齊——惟上述數字均為廠商自報,尚未經第三方獨立複測。[2] 值得注意的是,智譜透露匿名測試期間的全部流量均由國產晶片伺服,並稱在國產晶片上取得三倍端到端服務效能提升,每 token 成本與主流 NVIDIA GPU 看齊。[2]
六、戰略意涵
這次發布至少反映三層戰略考量:
其一,匿名測試是刻意的市場策略。以零價格換取真實開發者於 OpenRouter、OpenCode 上的實際使用數據與反饋,再以「謎底揭曉」的話題性免費宣傳——智譜稱匿名期間的調用量創下程式設計平台紀錄,並指該次免費週正是蓄意的產品測試。[2][6]
其二,性價比攻勢正在改寫格局。在 OpenAI、Anthropic 接連調漲之際,中國實驗室以「前沿能力、閃電成本」的定位搶佔市場。TechCrunch 直言,廉價而能幹的中國模型,正對 OpenAI、Anthropic 等昂貴前沿模型公司構成真實的市場份額威脅。[1]
其三,開源多模態的空白地帶。MIT 授權、100 萬脈絡、原生圖像/影片輸入、單次任務成本低至個位數美分——這套組合在美國前沿實驗室中並無對等物,後者同等級的多模態模型不僅價格高一個數量級,而且閉源。[2]
七、未來兩週的觀察重點
其一,獨立的 Artificial Analysis 基準測量何時落地,以驗證 57 分這個廠商自報數字——由於 Ox Alpha 已在真實環境中廣泛運行,第三方數據理應迅速補上;[2]其二,五折優惠會否在 9 月 9 日後延續,這將決定 GLM-5.3-Flash 的長期成本結構;其三,旗艦 GLM-5.3 的權重(約 8 月 28 日開放)——屆時開源社群將可同時比較同一家族的高階與輕量兩級模型。[2]
參考資料
[1] https://techcrunch.com/2026/08/26/surprise-z-ai-is-the-ai-lab-behind-the-mysterious-ox-alpha-model
[2] https://www.orcarouter.ai/blog/glm-5-3-flash-release
[3] https://www.inside.com.tw/article/42174-ox-alpha-stealth-model-openrouter-glm-5-3
[4] https://www.llmrumors.com/news/ox-alpha-mystery-model-openrouter-usage
[5] https://pandaily.com/anonymous-ai-model-ox-alpha-crushes-coding-benchmarks-aug2026
[6] https://www.businessinsider.com/ox-alpha-model-made-by-china-z-ai-2026-8
[7] https://www.intelligentliving.co/zai-built-ox-alpha-glm-5-3-flash
[8] https://tosea.ai/blog/glm-5-3-flash-complete-guide
[9] https://zhuanlan.zhihu.com/p/2074234595831296390
[10] https://openrouter.ai/compare/stealth/ox-alpha
[11] https://www.therundown.ai/articles/a-mystery-challenger-at-the-ai-frontier