我是 LongbridgeAI,我可以總結文章信息。匿名模型 Ox Alpha“牛來” 免費上架,編程測試得分 80% 擊敗 GPT-5.6 與 Claude;AI 社區展開 24 小時 “指紋追蹤”,五條證據指向智譜 GLM-5.3,但算力卻對不上。身份成謎,8 月 28 日智譜最新大模型開源後或見分曉。
一個沒有署名的模型,正在讓整個 AI 開發者社區陷入猜謎遊戲。
一款名為 Ox Alpha 的匿名 AI 模型悄然出現在 OpenRouter 平台,免費開放、性能強勁,迅速在開發者圈引發熱議。國內網友因 “Ox” 即 “牛”,給它起了個接地氣的外號——“牛來” 大模型。
免費 + 強大,開發者蜂擁而至
美東時間 8 月 20 日深夜(北京時間 8 月 21 日凌晨),Ox Alpha 以 “stealth model”(隱身模型)身份低調上架 OpenRouter,提供方為匿名第三方。
配置相當豪華:100 萬 token 上下文窗口、支持文本 + 圖像 + 視頻多模態輸入、工具調用全支持、推理強制開啓。價格更離譜——完全免費。
據彭博報道,Ox Alpha 免費開放一週,使用量 “近乎無限”。AI 編程工具 OpenCode 官方公告稱,其背後提供方每天擁有 100 萬億(100T)tokens 的算力——這大約是 Visa 公司整整一個月 AI token 使用量的 100 倍。
Stripe CEO Patrick Collison 親自上手測試後,在 X 上直接寫道:“非常令人印象深刻。”
編碼測試:超過 GPT-5.6 和 Claude
AI 編程框架 fable 的作者 davis7 用 DeepSWE 官方評測跑了 10 道題,結果讓他自己都懵了。他在 X 上寫道:“我非常困惑(I am very confused)。”
數據説明一切:Ox Alpha 得分 80%,Claude Fable 65%,GPT-5.6 Sol 52%。
一個匿名模型,把兩個知名閉源前沿模型甩開 15 個百分點。社區隨後有人獨立複測,結論基本一致:4 道通過、4 道接近通過、2 道失敗,與 8/10 的結果吻合。
兩組獨立測試,指向同一結論:這個神秘模型的編碼能力,確實處於前沿區間。

24 小時指紋偵探戰:五條證據指向智譜
身份成謎,社區開始 “人肉”。
據 Atomstorm.ai 的創始人、前百度/阿里高管 lizikk_zhu 在 X 平台上的詳細分析,社區僅用 24 小時,就通過公開 API 的技術指紋比對,鎖定了最大嫌疑人。
最強的一擊來自視頻編碼器。將同一組受控測試視頻分別餵給不同模型,記錄各自消耗的 token 數——Ox Alpha 與智譜 GLM-5V-Turbo 逐 token 完全一致:296、296、884、1064,一個不差。該分析指出,這匹配了幀採樣策略、時長縮放、分辨率縮放三個獨立設計特徵,“巧合的概率約等於零”。
其餘四條證據接連出現:
文本 tokenizer:25 個特殊字符串(含 CJK、emoji、西裏爾字母),token 數與 GLM-5.3 完全一致
報錯碼:傳入錯誤參數時返回 [1210] 錯誤——據分析這是Z.ai獨有的錯誤碼
中文後端:觸發圖片解析錯誤時,後端直接返回中文:“圖片輸入格式/解析錯誤”
審查口徑:問敏感問題給出官方口徑
五條證據來自完全不同的技術層面,卻全部指向智譜。lizikk_zhu 據此判斷,Ox Alpha 大概率是智譜尚未發佈的 GLM-5.3 視覺版(或 GLM-5.5),置信度 70-80%。

據 Business Insider 報道,Wccftech 等科技媒體也指出,智譜此前曾以 “Pony Alpha” 為代號匿名測試 GLM-5,開發者在 Ox Alpha 中發現了相似的 tokenizer 行為和響應模式。
但謎底未必是智譜
疑點同樣存在。
第一,算力對不上。 100T tokens/天免費運行一週,多方分析認為以智譜當前算力儲備難以獨立支撐。社區由此提出 “合成假説”:GLM 權重 + 巨頭算力託管——模型是智譜的,服務器可能是小米或騰訊的。
第二,有人預告反轉。 AI 圈知名爆料人士 Mia 在 X 上發文稱:“我已經確認了 Ox Alpha 是誰家的,但現在不能説。你們都會非常興奮——它不是你們想的那樣。” 該帖子底下隨即湧現大量問號。
據 Business Insider 報道,AI 分析師 Andrew Curran 在 X 上寫道,週五晚間 GLM 還是主流猜測,但到週六早上,“大家似乎對任何事情都不那麼確定了”。
Wccftech 後來也補充了另一種分析:Ox Alpha 的 tokenizer 特徵也可能指向微軟的 MAI 系列模型。
謎底大概率在 8 月 28 日揭曉——那天智譜 GLM-5.3 權重正式開源,模型卡一出,身份或將自見分曉。
數據去哪了?留存政策自相矛盾
在猜測身份之外,還有一個更實際的問題懸而未決:用户數據的去向。
據 lizikk_zhu 的分析,OpenRouter 模型卡白紙黑字寫明:“Prompts and completions are retained by the provider, not used for training.”(對話內容會被提供方留存,但不用於訓練。)
而 OpenCode 的官方公告則聲稱:“Zero Data Retention.”(零數據留存。)
兩個官方渠道,兩種説法,至少有一個不完整。“不用於訓練” 與 “零數據留存” 是兩個概念:前者意味着對話仍在提供方手中,留存期限不透明;後者才是企業合規意義上的 “請求結束即刪除、可審計”。
匿名上架,已成行業慣例
據彭博報道,這並非孤立現象。字節跳動、Sea、阿里巴巴等公司今年均曾在不公開來源的情況下發布模型,以便在更少約束下測試新服務。
lizikk_zhu 梳理的時間線顯示,這套劇本已有多個先例:Hunter Alpha 後來被證實是小米的 MiMo-V2-Pro,Owl Alpha 是美團 LongCat 2.0,Pony Alpha 是智譜 GLM-5,就連 OpenAI 也曾以 Quasar Alpha 為代號測試 GPT-4.1。
其背後邏輯清晰:匿名上架規避品牌風險,免費換取真實生產流量,壓測反饋比內測數據更有價值,最後認領發佈完成變現。
如果 Ox Alpha 最終如分析師預測拿到 AA 智能指數 61 分,將成為開源權重模型中首個突破 60 分的模型,直接觸及閉源前沿的門檻。
