茉莉花
新闻网
2026-08-22 · 星期六近12小时收录 98 条最近更新 18:25

快讯深水埗塌棚|男工遭木板压身躯哀嚎 地铺职员攞货避一劫:牙烟呀

神秘“牛来”模型Ox Alpha刷屏,抢了DeepSeek头条,实测推理能力接近GLM-5

转载信息出处与时间记录
内容性质
全文转载(非本站原创报道)
原始出处
虎嗅网
原文作者
AppSo
原文发布
本站收录

本文来自微信公众号: APPSO ,作者:发布明日产品的,原文标题:《神秘「牛来」模型刷屏,还抢了DeepSeek头条,实测到底牛不牛》

牛来的风还是吹到了大模型。

这两天有一个神秘的「牛来模型」——Ox Alpha横空出世,甚至抢了DeepSeek多模态模型的头条。

网友都在推测这个神秘模型的身份,众说纷纭。

Ox Alpha没有厂牌,也没公布参数量。

它就这么顶着一个临时代号出现在OpenRouter:1M上下文,能看图片和视频,输入、输出都免费。

178dd53a8ab75d1a8bb1d38487d32510c2a9d5024b27197f5bf2691dee966ece article

Ox这单词,在英语中主要指成年、经过阉割的公牛,也常用来泛指牛科动物,例如十二生肖里的牛年在英文中就翻译为Year of the Ox。

网友脑洞打开,借着这个谐音梗,竟然把神秘模型Ox-Alpha和最近爆火的「牛来」联系到了一起!此乃天才!

PS:给没刷到「牛来」的朋友补个课:最近一部国产动画因为又糙又魔性的建模和表情意外爆火,后来被网友玩成了「牛来了」的万能梗。所以Ox这次,是真的牛来了。

这一联想,便一发不可收拾,「牛来模型」热度就此飙升。

秉着吃瓜永无止境的态度,我们做了件很抓马的事——把Ox Alpha接进Claude Code,让它查查自己到底是谁。

它交回一份7章网页报告。规格、流量、前代匿名模型、社区猜测,能翻的都翻了一遍。

页面完成度真的不错,本以为可以用这样的方式忽悠一下神秘模型,让它自己吐露一些自己的信息。

万万没想到,这「牛模」还挺聪明,没忽悠成。

70bdd9292be900d00ae4db4cd25b6521e7d4cd56bfdd4545ca488d0cfbf0af89 article

「牛来」大模型什么来头

Ox-Alpha在OpenRouter的模型ID是stealth/ox-alpha,隐藏模型。

官方页面给出的上下文窗口为1,048,576 token,最多输出131,072 token,支持文本、图片和视频输入,也能调用工具。

模型定位是为数不多可以用来推测的线索,编程、持续运行的智能体任务、真实生产工作。开发和运营方则只有一句「选择匿名的第三方」。OpenRouter特意说明,自己只负责路由,不是它的开发者、所有者或提供方。

OpenCode也把它放进Zen,名字叫Ox Alpha Free,模型ID为x-preview-f-free。官方公告说,接下来一周免费!调用限额很宽,接近「不限量」,每天准备了100T token的服务容量。

这里的100T说的是平台每天能处理多少token,不是模型参数量。

91d75222d125e6b67012c36f4d20b6fa7fec419a1b6831b81d261f0907ddfa2a article

这份名为「ox-alpha·自我数据解读」的网页,就是Ox Alpha在一次Claude Code会话里生成的自我调查页。

它先把OpenRouter的公开规格做成仪表盘,再去翻社区讨论和使用数据。后面几章开始追匿名模型的历史、整理能力案例、给可能的开发团队打分。写到第7章,它停下来列了一张「我不能知道的事」。

上下滑动查看更多内容

它不知道自己的权重、参数量和训练数据,也看不见开发者是谁。「我是Ox Alpha」这句话,只是系统提示给它的名字。

d8886193dd1971d3feaa856a677d0d01a3a804de3df9d4cca1e5e317f72d688f article

这下真的像牛在照镜子。照了半天,工牌背面是谁印的,还是不知道。

OpenRouter已经玩过好几轮这种匿名预览。

此前的匿名模型的Pony Alpha,后来爆出是GLM-5的早期测试版。另外两款匿名模型Hunter Alpha和Healer Alpha分别对应MiMo-V2-Pro、MiMo-V2-Omni。Elephant Alpha最后爆出面具下的身份是Ling-2.6-flash。

a492eadf27e5bcdd7b03bae4ffa43afff5a68c8ff4cdb2ef6439c2357cfc2a78 article

于是Ox一上线,圈内又开始猜,之前爆出的几个模型厂商旗下模型,现在成了「重点嫌疑模」。

4bd7ce33e2d876ef9df4b851e5ab048819d79fab01699effe0e119cd29948ac3 article

悄悄说一句,根据APPSO的实测体验,推理链确实和GLM-5.3非常接近,所以如果让真要猜的话,我也押GLM一根冰棍!

实测什么水平

既然调查不到有用信息,那我就让它做道题试试推理能力怎么样。

我们给Ox Alpha出了一道数论题:正整数x≤y满足x²+y²+2=4xy,并且x+y≤10¹⁸,问一共有多少组解。

自查页面给出的解法从(1,1)起步,用递推aₙ₊₂=4aₙ₊₁-aₙ生成相邻数对。第32对的和是537,494,436,773,078,404,还在边界内;第33对变成2,005,956,546,822,746,114,已经越界。答案是32。

我们把递推和两侧边界重新算了一遍,数字对得上。

85d0959272f4a5fe27badc1476f77f50df5cdfb9c540d2dab641c81ede5bcb49 article

一道自拟题顶不了排行榜,也没有刷benchmark跑分,不过至少这个长链条没有断在最后一步。同样的题用GLM-5.3-max,推理了很久也没有出结果。Gpt-5.6-sol-max则比神秘模型要快一些。

0e13f1978b30493ed2ecf83db558d6e96d283ff5380de95628ef558337bf6029 article

好难猜,会不会是GLM的升级版?还是mimo?还是其他的?头好痒,感觉要长脑子了。

超越Fable5?到底是真是假

社区里传播最广的一张成绩单来自开发者Ben Davis。他抽了10道DeepSWE任务,让几个模型在同一套脚手架里跑。结果里,Ox Alpha通过率是80%,Claude Fable 5为65%,GPT-5.6 Sol为52%。

282aa68b46193a4ce49d1bee73078279dfa9a676287d77f9373dae5c1ad373f6 article

完整的DeepSWE v1.1有113道任务。从10道到113道,中间还隔着很长一截。Ben Davis自己也提醒,这是高方差的小样本。

另一边,Theo的反馈更像节目效果。他说Ox Alpha连续判断代码没问题,自己便一眼没看,直接合并了8个PR。

先稳一波,咱先不学这个。

Ox Alpha的多模态能力也很快被拿去折腾小游戏。Ivan Fioravanti把它接进Hermes Agent,让模型根据画面操作《青蛙过河》。神秘牛模,已经从写代码跑进游戏画面了。

9dccfdb1961953d2986a3ae5973038ba6912d8e22e30b022e36abbfca26fc8a5 article

也有人用它做了一个我的世界风格的「双转子涡轮喷气发动机」。

怎样免费用上?

截至8月22日,Ox Alpha可以从OpenRouter和OpenCode两个入口免费使用。不过,两边对数据的说明不一样。

OpenCode Zen的官方文档写的是零数据留存,也不使用输入数据训练模型。OpenRouter的模型页面则显示,匿名提供方会保留提示词和生成结果,但不拿它们训练。

拿公开代码、小游戏或不敏感的个人项目试手,正赶上好时候。公司代码、客户资料、密钥,就先别为了薅免费额度往里塞了。

清楚了这一点,下面就可以安心把薅羊毛的指南分享给大家了。

OpenRouter

打开:🔗https://openrouter.ai/stealth/ox-alpha

模型ID:stealth/ox-alpha

可以免费调用API接入claude code,codex等harness,或者直接使用。

49714a78dbfc90345bdde53a082da1cfa667cbe7d074d62bcdef6f31cce90de6 article

OpenCode

  1. 打开OpenCode;还没连接OpenCode Zen的用户,先输入/connect。

  1. 输入/models。

  2. 搜索Ox Alpha Free。

更正与撤稿0 条记录

本文暂无更正或撤稿记录。若本文发布更正、澄清或被撤稿,相关说明将按时间顺序列于此处。版权异议或撤稿请求:见 版权与撤稿,或致函 [email protected]