神秘模型爆了!牛来?

神秘模型爆了!牛来?

2026/08/2415 分钟
分类:学习思考
标签:#AI#AI大模型#免费额度#OpenRouter#工具
📡
本文首发于黑粉科技公众号

神秘模型爆了 牛来?

stealth/ox-alpha:没有公司,没有仓库,没有名字 104 万上下文,能看视频,完全免费,两天冲上调用量第一
🗓
黑粉科技 · 官方接口实取 · 2026-08-24

这个八月中文互联网出了两件同构的事。一件是电影《牛来》——一部画面粗糙到被网友当成行为艺术的国产动画,首日票房三千多块,然后靠着“我倒要看看到底有多抽象”的集体围观,一路冲到四千多万。另一件发生在 8 月 20 日晚上八点零四分(世界标准时间):OpenRouter 的模型列表里多了一行 `stealth/ox-alpha`。

没有发布会,没有公司博客,没有 HuggingFace 仓库,连开发它的是谁都不知道。四天后我去查它的调用量——在这个平台上跑得最多的两个应用,加起来给它送了 3.36 万亿个 token。两件事的形状一模一样:无名之辈,突然爆红,所有人都想亲眼确认一下。

这几天它在中文圈也火了。零度解说 8 月 22 日发了一期实测,四万八千多次播放:把它接进编程工具,一条提示生成能在浏览器里跑的游戏,十几分钟做出一个用 A、D 键交替换腿、空格冲刺的赛跑小游戏,还拿同一条提示让它和 GPT-5.6、Fable 5 各画一个史瓦西黑洞做横向对比。这些是别人的测试结果,我原样转述,没有复现。

热闹归热闹,我更关心两件不用靠演示就能确认的事:它到底是什么规格,以及免费的代价写在哪。这两件事官方接口和页面上都写得清清楚楚,任何人都能自己拉一遍对一遍——所以下面的数字我全部走接口实取,不引用二手报道。

🔑
先给结论:这是一个真正能干活的前沿规格模型,而且它把代价明明白白写在了页面第一段——你的输入和它的输出,提供方全部留存。不是偷偷摸摸,是你自己没看。

▍🕶️ 什么叫 stealth 模型

先解释这个词,不然后面全是误会。stealth 模型指的是模型方主动选择匿名,把权重挂在别人的推理平台上先跑一段。平台负责接单和转发,但明确声明自己不是开发者、不是所有者、不是提供方。OpenRouter 在页面上写得很直接:它只负责把请求转过去。

为什么要这么干?通常是为了在正式发布前拿到真实世界的使用数据——真实的提示词、真实的长任务、真实的失败案例。实验室内部的评测集再大,也不如几万个开发者拿它写生产代码来得诚实。用免费换真实流量,这是笔明码标价的交易,只不过标价的位置很多人不看。这套剧本在开发者工具上反复演过:免费层先把真实工作流吃进来,等你的流水线离不开它了再谈价钱。

这种玩法不是第一次。早在各家大模型还在拼榜单的时候,就有厂商用代号在竞技场里匿名投放,等胜率跑出来再揭晓身份。Ox Alpha 把这套做得更彻底:它不只是名字匿名,是连能反查身份的字段都一并清空了


▍📐 规格:接口里拿到的原始数字

我没有引用任何二手报道,直接拉了 OpenRouter 的模型列表接口。这是它返回的原始字段——每一项都能自己复现一遍。

字段实际值意味着什么
idstealth/ox-alpha命名空间就叫 stealth,平台侧承认它是匿名投放
context_length1,048,576104 万 token,整个中型代码库能一次塞进去
max_completion_tokens131,072单次能吐 13 万,长文件重写不用切片
modalitytext+image+video → text文字、图片、视频三种输入,只出文字
pricing(prompt / completion)0 / 0输入输出都不计费,不是折扣是零
tokenizerOther连分词器族系都没写
hugging_face_idnull没有可对应的公开权重仓库

※ 数据来源:https://openrouter.ai/api/v1/models,2026-08-24 实取。created 字段换算为 2026-08-20 20:04 UTC。

能力侧也不是花架子:它接受 tools 和 tool_choice 做函数调用,支持 response_format 出 JSON(但不强制 schema)。页面把它定位成面向编程、长程 agent 工作和生产负载的推理模型。这几个词连起来,说的是同一件事——它是给你拿去干活的,不是拿去聊天的。

104 万上下文和 13 万单次输出这组数字,落到实际操作上是这样的:一个中型项目的全部源码加上依赖说明,通常几十万 token 就装得下,意味着你不用再写切片逻辑、不用再维护「哪几个文件一起喂」的启发式规则,整个塞进去让它自己找。13 万的输出上限则决定了它能不能一次把一个大文件重写完——很多模型卡的不是理解,是写到一半被输出上限截断,你还得拼接。这两项凑齐,长程改代码这件事才算真的能跑。

运行指标实测值口径
吞吐24 token/秒P50,全平台最优
延迟5.14 秒P50,最优提供方
3 日在线率100.00%至少一个提供方在响应
3 日可用率99.45%推理被成功服务的时间占比
提供方数量1 家单一托管,OpenRouter 不做路由选择

※ 数据来自 OpenRouter 模型页 2026-08-24 显示值。24 token/秒是平台侧统计,不是我本机实测。


▍🧾 代价:它自己写在第一段

# 接口返回的原始字段:定价两个零,hugging_face_id 与 knowledge_cutoff 都是 null,tokenizer 只写 Other
# 接口返回的原始字段:定价两个零,hugging_face_id 与 knowledge_cutoff 都是 null,tokenizer 只写 Other

页面顶部那段横幅,原文是这么写的:请求与回复由提供方留存,不用于训练,其余用途适用「隐身模型条款」。翻译成人话——能确认的只有“留着”,不用于训练是它的声明,除此之外拿去做什么,你只能推断。

⚠️
这句话值得停一下。免费模型常见的说法是“会用于改进服务”,那至少还指了个方向。这里的措辞是留存 + 排除一项用途,剩下的用途空间没有描述。再叠上提供方匿名——你连找谁问都不知道。所以判断很简单:开源项目、公开资料、练手脚本随便喂;公司代码、客户数据、密钥,一个字都别过去。

再看身份字段的处理方式。`hugging_face_id` 是空,`knowledge_cutoff` 是空,`tokenizer` 写的是 `Other`。这三个字段平时是拿来做技术溯源的——你能靠它们判断这模型是谁家的底座、训练数据截到哪天。它们不是“还没来得及填”,是被逐个抹平的。匿名做到这个颗粒度,是设计,不是疏忽。

顺带说个判断免费入口的经验。当年大家看一个接口还能不能用,是去翻文档;后来都学乖了,改成直接发一个请求看报错码。原因很简单:文档是去年写的,报错是今天返回的。Ox Alpha 这种情况更要这么看——它的免费期按官方口径只有一周左右,什么时候切断、切断后是什么价,页面上一个字都没写。你的脚本得能扛住某天早上突然收到计费错误或者 404。


▍📈 两天冲上第一:谁在喂它

# 公开应用榜:跑在它上面的第一名是 Hermes Agent,第二名是 Claude Code
# 公开应用榜:跑在它上面的第一名是 Hermes Agent,第二名是 Claude Code

OpenRouter 会公开每个模型的应用榜。Ox Alpha 上面排第一的是 Hermes Agent,第二是 Claude Code——两个都是长任务型的编程 agent,不是聊天前端。这个组合本身就说明了它被拿去干什么:不是问答,是让它连续干几十分钟的活。

应用8 月 23 日8 月 24 日一天变化
Hermes Agent1.2T token2.25T token接近翻倍
Claude Code615B token1.11T token接近翻倍

※ 8 月 23 日数值取自当日抓取的应用榜截图,8 月 24 日为本文发稿前实取。T = 万亿,B = 十亿。

一天之内两个头部应用的用量都接近翻倍——免费又能干活,开发者是很诚实的。但反过来看也成立:这条曲线越陡,提供方拿到的真实生产数据就越多。免费期设成一周左右,正好够跑出一轮完整的使用画像。

这条曲线让我又想起《牛来》。那部片子的传播动力不是“它好看”,是“大家都在看,我不能只有我一个人不知道”。Ox Alpha 也一样:开发者涌进来的第一动机是“免费的前沿模型,先囤上再说”,而不是“我评估完觉得它最合适”。围观驱动的曲线涨得快,但它测出来的是好奇心,不是长期偏好——真正的评价要等收费之后才看得出来。


▍💰 谁赚、谁亏、谁不说话

谁赚:提供方。它花的是推理成本,换回来的是几万亿 token 的真实生产提示词——这批数据在公开市场上买不到,因为没人会把自己的生产代码卖给你。免费期的每一次调用,都是它在收集一份别处买不来的样本。

谁省:开发者。104 万上下文加长任务能力,按主流前沿模型的价目算,跑满一周不是小数字。这笔钱现在是零。谁沉默:提供方自己。它不说自己是谁,不说模型底座是什么,不说留存下来的数据要保存多久、存在哪个司法辖区。沉默的地方往往才是结论。

它为什么现在做这件事、图什么——看它给自己贴的标签就够了:编程、长程 agent、生产负载。这三个词对应的是当下推理消耗最凶、也最愿意付钱的那批用户。它抢的是这批人的入口:先用免费把真实工作流拿到手,等定价的时候你已经改不动流水线了。顺序是想清楚了的,不是随手发一个模型出来看看反响。

还有一条能佐证动机的细节:免费期设的是一周左右,不是一个月,也不是永久。一周刚好够跑完一轮完整的使用画像,又短到你来不及把它当成基础设施。这不像在做慈善,更像在做一次有明确采集窗口的田野调查。


▍🛰️ 说个我自己的事:我的采集管道漏了它三天

我有一条每天早上七点跑的选题采集管道,专门盯 AI 圈的新东西。Ox Alpha 8 月 20 日上线,而我的管道 8 月 20 日选了 Codex 历史记录的开源替代,8 月 21 日选了 llama.cpp 改版本号,8 月 22 日选了 OpenAI 开源 Codex 引擎。它整整三天没看见这个模型。

# 422 个在册模型里,输入输出双零定价的共 22 个——其中 18 个带 :free 后缀,另外 4 个不带
# 422 个在册模型里,输入输出双零定价的共 22 个——其中 18 个带 :free 后缀,另外 4 个不带

查完根因我有点服气,因为漏得非常合理。我的模型发布信源一共 12 条:六家大厂的官方博客 RSS,四个写死的 GitHub 仓库 Release,两家科技媒体。这 12 条源的共同前提是“某个已知厂商发布了什么”——而 Ox Alpha 没有厂商。它对我的信源天然不可见,不是抓失败,是压根不在视野里。早在这套信源表建起来的时候,模型发布就等于开发布会加传权重,那时候这个假设是成立的;现在不成立了,表却没改。

第二个原因更具体。我确实在抓 OpenRouter,但判据只有一行:模型 id 里含不含 `:free`。我刚才实测了一遍——在册 422 个模型里定价全零的有 22 个,带 `:free` 后缀的只有 18 个,剩下 4 个被这行判据直接跳过,`stealth/ox-alpha` 就在里面。判据把“免费”和“名字里写了 free”划了等号,而这个模型是零定价但不带后缀。

🎯
这两条错误其实是同一个:我把“新模型”定义成了“厂商公布的东西”,把“免费”定义成了“名字里带 free”。定义写窄了,最该抓的那类东西正好落在窄掉的那一格里。修法也直接——按平台目录的增量做发现,按价格字段判免费,不看名字。

▍🧭 要不要用,怎么用

值得试,前提是分清楚喂什么。它的规格是真的:104 万上下文、13 万输出、能读图能读视频、支持函数调用,这几项凑齐的免费模型目前没有第二个。免费期按官方口径是一周左右,什么时候结束、结束后什么价,页面上没说。

你想干的事建议为什么
读超长代码库、跨文件重构可以用104 万上下文 + 13 万单次输出,切片成本省掉
长程 agent、跑几十分钟的任务可以用它自己就是按这个定位做的,榜首两个应用都是这类
带图带视频的理解任务可以用三模态输入,同价位没有替代
公司代码、客户数据、密钥别碰留存写在明面上,且提供方匿名,出事找不到人
当长期主力接进生产先别免费期约一周,之后定价未知,单一提供方无冗余

还有一条容易被忽略的风险:它只有一家提供方在托管,OpenRouter 页面上明写着不做路由选择。平常多提供方的模型某一家挂了会自动切走,它没有这个退路——这三天的可用率是 99.45%,不是 100%。真接进流水线的话,得自己准备一条降级路径,别让整条链路吊在一个匿名提供方身上。

上手路径很短:在 OpenRouter 注册拿一个免费 API Key,模型 id 填 `stealth/ox-alpha`,接口是 OpenAI 兼容格式,任何支持自定义 base URL 的客户端直接就能用。要接编程 agent 的话,榜单上那两个应用已经替你验证过它扛不扛得住长任务了。

最后回到开头那个对照。《牛来》最出圈的一句反讽是“国漫之光,AI 都写不出”——网友用它调侃那种笨拙到无法被复制的手工感。有意思的是,这个八月和它并排爆红的另一个无名之辈,恰恰就是一个 AI。一个靠“粗糙到不像机器做的”出圈,一个靠“好用到不知道是谁做的”出圈,中间隔着的是同一件事:我们越来越习惯先围观,再判断。


📌
一句话收尾 Ox Alpha 是个规格实打实的前沿模型,免费、104 万上下文、能看视频,两天就冲到了调用量第一。它没有藏着代价——留存那句话就写在页面第一段,藏起来的是自己的身份。所以用法很清楚:拿它干公开的活,别拿它碰私密的数据。顺带一提,它也让我发现自己的选题雷达把“新模型”定义得太窄了。


▍📚 数据来源与复现入口

  • OpenRouter · Ox Alpha 模型页:https://openrouter.ai/stealth/ox-alpha
  • OpenRouter 模型列表 API(本文数据来源):https://openrouter.ai/api/v1/models
  • 零度解说的实测视频(2026-08-22):https://www.youtube.com/watch?v=yhhyFO6hSTs
分享到:

相关文章

返回首页