2026-08-22 15:56

神秘“牛来”模型刷屏,还抢了DeepSeek头条,实测到底牛不牛

author_path AppSo
头图

本文来自微信公众号: APPSO ,作者:发布明日产品的,原文标题:《神秘「牛来」模型刷屏,还抢了DeepSeek头条,实测到底牛不牛》


牛来的风还是吹到了大模型。


这两天有一个神秘的「牛来模型」——Ox Alpha横空出世,甚至抢了DeepSeek多模态模型的头条。


网友都在推测这个神秘模型的身份,众说纷纭。


Ox Alpha没有厂牌,也没公布参数量。


它就这么顶着一个临时代号出现在OpenRouter:1M上下文,能看图片和视频,输入、输出都免费。



Ox这单词,在英语中主要指成年、经过阉割的公牛,也常用来泛指牛科动物,例如十二生肖里的牛年在英文中就翻译为Year of the Ox。


网友脑洞打开,借着这个谐音梗,竟然把神秘模型Ox-Alpha和最近爆火的「牛来」联系到了一起!此乃天才!


PS:给没刷到「牛来」的朋友补个课:最近一部国产动画因为又糙又魔性的建模和表情意外爆火,后来被网友玩成了「牛来了」的万能梗。所以Ox这次,是真的牛来了。


这一联想,便一发不可收拾,「牛来模型」热度就此飙升。


秉着吃瓜永无止境的态度,我们做了件很抓马的事——把Ox Alpha接进Claude Code,让它查查自己到底是谁。


它交回一份7章网页报告。规格、流量、前代匿名模型、社区猜测,能翻的都翻了一遍。


页面完成度真的不错,本以为可以用这样的方式忽悠一下神秘模型,让它自己吐露一些自己的信息。


万万没想到,这「牛模」还挺聪明,没忽悠成。



「牛来」大模型什么来头


Ox-Alpha在OpenRouter的模型ID是stealth/ox-alpha,隐藏模型。


官方页面给出的上下文窗口为1,048,576 token,最多输出131,072 token,支持文本、图片和视频输入,也能调用工具。


模型定位是为数不多可以用来推测的线索,编程、持续运行的智能体任务、真实生产工作。开发和运营方则只有一句「选择匿名的第三方」。OpenRouter特意说明,自己只负责路由,不是它的开发者、所有者或提供方。


OpenCode也把它放进Zen,名字叫Ox Alpha Free,模型ID为x-preview-f-free。官方公告说,接下来一周免费!调用限额很宽,接近「不限量」,每天准备了100T token的服务容量。


这里的100T说的是平台每天能处理多少token,不是模型参数量。



这份名为「ox-alpha·自我数据解读」的网页,就是Ox Alpha在一次Claude Code会话里生成的自我调查页。


它先把OpenRouter的公开规格做成仪表盘,再去翻社区讨论和使用数据。后面几章开始追匿名模型的历史、整理能力案例、给可能的开发团队打分。写到第7章,它停下来列了一张「我不能知道的事」。


上下滑动查看更多内容


它不知道自己的权重、参数量和训练数据,也看不见开发者是谁。「我是Ox Alpha」这句话,只是系统提示给它的名字。



这下真的像牛在照镜子。照了半天,工牌背面是谁印的,还是不知道。


OpenRouter已经玩过好几轮这种匿名预览。


此前的匿名模型的Pony Alpha,后来爆出是GLM-5的早期测试版。另外两款匿名模型Hunter Alpha和Healer Alpha分别对应MiMo-V2-Pro、MiMo-V2-Omni。Elephant Alpha最后爆出面具下的身份是Ling-2.6-flash。



于是Ox一上线,圈内又开始猜,之前爆出的几个模型厂商旗下模型,现在成了「重点嫌疑模」。



悄悄说一句,根据APPSO的实测体验,推理链确实和GLM-5.3非常接近,所以如果让真要猜的话,我也押GLM一根冰棍!


实测什么水平


既然调查不到有用信息,那我就让它做道题试试推理能力怎么样。


我们给Ox Alpha出了一道数论题:正整数x≤y满足x²+y²+2=4xy,并且x+y≤10¹⁸,问一共有多少组解。


自查页面给出的解法从(1,1)起步,用递推aₙ₊₂=4aₙ₊₁-aₙ生成相邻数对。第32对的和是537,494,436,773,078,404,还在边界内;第33对变成2,005,956,546,822,746,114,已经越界。答案是32。


我们把递推和两侧边界重新算了一遍,数字对得上。



一道自拟题顶不了排行榜,也没有刷benchmark跑分,不过至少这个长链条没有断在最后一步。同样的题用GLM-5.3-max,推理了很久也没有出结果。Gpt-5.6-sol-max则比神秘模型要快一些。



好难猜,会不会是GLM的升级版?还是mimo?还是其他的?头好痒,感觉要长脑子了。


超越Fable5?到底是真是假


社区里传播最广的一张成绩单来自开发者Ben Davis。他抽了10道DeepSWE任务,让几个模型在同一套脚手架里跑。结果里,Ox Alpha通过率是80%,Claude Fable 5为65%,GPT-5.6 Sol为52%。



完整的DeepSWE v1.1有113道任务。从10道到113道,中间还隔着很长一截。Ben Davis自己也提醒,这是高方差的小样本。


另一边,Theo的反馈更像节目效果。他说Ox Alpha连续判断代码没问题,自己便一眼没看,直接合并了8个PR。


先稳一波,咱先不学这个。


Ox Alpha的多模态能力也很快被拿去折腾小游戏。Ivan Fioravanti把它接进Hermes Agent,让模型根据画面操作《青蛙过河》。神秘牛模,已经从写代码跑进游戏画面了。



也有人用它做了一个我的世界风格的「双转子涡轮喷气发动机」。


怎样免费用上?


截至8月22日,Ox Alpha可以从OpenRouter和OpenCode两个入口免费使用。不过,两边对数据的说明不一样。


OpenCode Zen的官方文档写的是零数据留存,也不使用输入数据训练模型。OpenRouter的模型页面则显示,匿名提供方会保留提示词和生成结果,但不拿它们训练。


拿公开代码、小游戏或不敏感的个人项目试手,正赶上好时候。公司代码、客户资料、密钥,就先别为了薅免费额度往里塞了。


清楚了这一点,下面就可以安心把薅羊毛的指南分享给大家了。


OpenRouter


打开:🔗https://openrouter.ai/stealth/ox-alpha


模型ID:stealth/ox-alpha


可以免费调用API接入claude code,codex等harness,或者直接使用。


OpenCode


  1. 打开OpenCode;还没连接OpenCode Zen的用户,先输入/connect。



  1. 输入/models。


  2. 搜索Ox Alpha Free。

本内容来源于网络 原文链接,观点仅代表作者本人,不代表虎嗅立场。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。