一个没有署名的模型,正在让整个 AI 开发者社区陷入猜谜游戏。
一款名为 Ox Alpha 的匿名 AI 模型悄然出现在 OpenRouter 平台,免费开放、性能强劲,迅速在开发者圈引发热议。国内网友因 "Ox" 即 " 牛 ",给它起了个接地气的外号——" 牛来 " 大模型。
免费 + 强大,开发者蜂拥而至
美东时间 8 月 20 日深夜(北京时间 8 月 21 日凌晨),Ox Alpha 以 "stealth model"(隐身模型)身份低调上架 OpenRouter,提供方为匿名第三方。
配置相当豪华:100 万 token 上下文窗口、支持文本 + 图像 + 视频多模态输入、工具调用全支持、推理强制开启。价格更离谱——完全免费。
据彭博报道,Ox Alpha 免费开放一周,使用量 " 近乎无限 "。AI 编程工具 OpenCode 官方公告称,其背后提供方每天拥有 100 万亿(100T)tokens 的算力——这大约是 Visa 公司整整一个月 AI token 使用量的 100 倍。
Stripe CEO Patrick Collison 亲自上手测试后,在 X 上直接写道:" 非常令人印象深刻。"
编码测试:超过 GPT-5.6 和 Claude
AI 编程框架 fable 的作者 davis7 用 DeepSWE 官方评测跑了 10 道题,结果让他自己都懵了。他在 X 上写道:" 我非常困惑(I am very confused)。"
数据说明一切:Ox Alpha 得分 80%,Claude Fable 65%,GPT-5.6 Sol 52%。
一个匿名模型,把两个知名闭源前沿模型甩开 15 个百分点。社区随后有人独立复测,结论基本一致:4 道通过、4 道接近通过、2 道失败,与 8/10 的结果吻合。
两组独立测试,指向同一结论:这个神秘模型的编码能力,确实处于前沿区间。

身份成谜,社区开始 " 人肉 "。
据 Atomstorm.ai 的创始人、前百度 / 阿里高管 lizikk_zhu 在 X 平台上的详细分析,社区仅用 24 小时,就通过公开 API 的技术指纹比对,锁定了最大嫌疑人。
最强的一击来自视频编码器。将同一组受控测试视频分别喂给不同模型,记录各自消耗的 token 数—— Ox Alpha 与智谱 GLM-5V-Turbo 逐 token 完全一致:296、296、884、1064,一个不差。该分析指出,这匹配了帧采样策略、时长缩放、分辨率缩放三个独立设计特征," 巧合的概率约等于零 "。
其余四条证据接连出现:
文本 tokenizer:25 个特殊字符串(含 CJK、emoji、西里尔字母),token 数与 GLM-5.3 完全一致
报错码:传入错误参数时返回 [ 1210 ] 错误——据分析这是Z.ai独有的错误码
中文后端:触发图片解析错误时,后端直接返回中文:" 图片输入格式 / 解析错误 "
审查口径:问敏感问题给出官方口径
五条证据来自完全不同的技术层面,却全部指向智谱。lizikk_zhu 据此判断,Ox Alpha 大概率是智谱尚未发布的 GLM-5.3 视觉版(或 GLM-5.5),置信度 70-80%。

但谜底未必是智谱
疑点同样存在。
第一,算力对不上。 100T tokens/ 天免费运行一周,多方分析认为以智谱当前算力储备难以独立支撑。社区由此提出 " 合成假说 ":GLM 权重 + 巨头算力托管——模型是智谱的,服务器可能是小米或腾讯的。
第二,有人预告反转。 AI 圈知名爆料人士 Mia 在 X 上发文称:" 我已经确认了 Ox Alpha 是谁家的,但现在不能说。你们都会非常兴奋——它不是你们想的那样。" 该帖子底下随即涌现大量问号。
据 Business Insider 报道,AI 分析师 Andrew Curran 在 X 上写道,周五晚间 GLM 还是主流猜测,但到周六早上," 大家似乎对任何事情都不那么确定了 "。
Wccftech 后来也补充了另一种分析:Ox Alpha 的 tokenizer 特征也可能指向微软的 MAI 系列模型。
谜底大概率在 8 月 28 日揭晓——那天智谱 GLM-5.3 权重正式开源,模型卡一出,身份或将自见分晓。
数据去哪了?留存政策自相矛盾
在猜测身份之外,还有一个更实际的问题悬而未决:用户数据的去向。
据 lizikk_zhu 的分析,OpenRouter 模型卡白纸黑字写明:"Prompts and completions are retained by the provider, not used for training."(对话内容会被提供方留存,但不用于训练。)
而 OpenCode 的官方公告则声称:"Zero Data Retention."(零数据留存。)
两个官方渠道,两种说法,至少有一个不完整。" 不用于训练 " 与 " 零数据留存 " 是两个概念:前者意味着对话仍在提供方手中,留存期限不透明;后者才是企业合规意义上的 " 请求结束即删除、可审计 "。
匿名上架,已成行业惯例
据彭博报道,这并非孤立现象。字节跳动、Sea、阿里巴巴等公司今年均曾在不公开来源的情况下发布模型,以便在更少约束下测试新服务。
lizikk_zhu 梳理的时间线显示,这套剧本已有多个先例:Hunter Alpha 后来被证实是小米的 MiMo-V2-Pro,Owl Alpha 是美团 LongCat 2.0,Pony Alpha 是智谱 GLM-5,就连 OpenAI 也曾以 Quasar Alpha 为代号测试 GPT-4.1。
其背后逻辑清晰:匿名上架规避品牌风险,免费换取真实生产流量,压测反馈比内测数据更有价值,最后认领发布完成变现。
如果 Ox Alpha 最终如分析师预测拿到 AA 智能指数 61 分,将成为开源权重模型中首个突破 60 分的模型,直接触及闭源前沿的门槛。