神秘模型爆了 牛来?
stealth/ox-alpha:没有公司,没有仓库,没有名字 104 万上下文,能看视频,完全免费,两天冲上调用量第一
这个八月中文互联网出了两件同构的事。一件是电影《牛来》——一部画面粗糙到被网友当成行为艺术的国产动画,首日票房三千多块,然后靠着“我倒要看看到底有多抽象”的集体围观,一路冲到四千多万。另一件发生在 8 月 20 日晚上八点零四分(世界标准时间):OpenRouter 的模型列表里多了一行 `stealth/ox-alpha`。
没有发布会,没有公司博客,没有 HuggingFace 仓库,连开发它的是谁都不知道。四天后我去查它的调用量——在这个平台上跑得最多的两个应用,加起来给它送了 3.36 万亿个 token。两件事的形状一模一样:无名之辈,突然爆红,所有人都想亲眼确认一下。
这几天它在中文圈也火了。零度解说 8 月 22 日发了一期实测,四万八千多次播放:把它接进编程工具,一条提示生成能在浏览器里跑的游戏,十几分钟做出一个用 A、D 键交替换腿、空格冲刺的赛跑小游戏,还拿同一条提示让它和 GPT-5.6、Fable 5 各画一个史瓦西黑洞做横向对比。这些是别人的测试结果,我原样转述,没有复现。
热闹归热闹,我更关心两件不用靠演示就能确认的事:它到底是什么规格,以及免费的代价写在哪。这两件事官方接口和页面上都写得清清楚楚,任何人都能自己拉一遍对一遍——所以下面的数字我全部走接口实取,不引用二手报道。
▍🕶️ 什么叫 stealth 模型
先解释这个词,不然后面全是误会。stealth 模型指的是模型方主动选择匿名,把权重挂在别人的推理平台上先跑一段。平台负责接单和转发,但明确声明自己不是开发者、不是所有者、不是提供方。OpenRouter 在页面上写得很直接:它只负责把请求转过去。
为什么要这么干?通常是为了在正式发布前拿到真实世界的使用数据——真实的提示词、真实的长任务、真实的失败案例。实验室内部的评测集再大,也不如几万个开发者拿它写生产代码来得诚实。用免费换真实流量,这是笔明码标价的交易,只不过标价的位置很多人不看。这套剧本在开发者工具上反复演过:免费层先把真实工作流吃进来,等你的流水线离不开它了再谈价钱。
这种玩法不是第一次。早在各家大模型还在拼榜单的时候,就有厂商用代号在竞技场里匿名投放,等胜率跑出来再揭晓身份。Ox Alpha 把这套做得更彻底:它不只是名字匿名,是连能反查身份的字段都一并清空了。
▍📐 规格:接口里拿到的原始数字
我没有引用任何二手报道,直接拉了 OpenRouter 的模型列表接口。这是它返回的原始字段——每一项都能自己复现一遍。
| 字段 | 实际值 | 意味着什么 |
|---|---|---|
| id | stealth/ox-alpha | 命名空间就叫 stealth,平台侧承认它是匿名投放 |
| context_length | 1,048,576 | 104 万 token,整个中型代码库能一次塞进去 |
| max_completion_tokens | 131,072 | 单次能吐 13 万,长文件重写不用切片 |
| modality | text+image+video → text | 文字、图片、视频三种输入,只出文字 |
| pricing(prompt / completion) | 0 / 0 | 输入输出都不计费,不是折扣是零 |
| tokenizer | Other | 连分词器族系都没写 |
| hugging_face_id | null | 没有可对应的公开权重仓库 |
※ 数据来源:https://openrouter.ai/api/v1/models,2026-08-24 实取。created 字段换算为 2026-08-20 20:04 UTC。
能力侧也不是花架子:它接受 tools 和 tool_choice 做函数调用,支持 response_format 出 JSON(但不强制 schema)。页面把它定位成面向编程、长程 agent 工作和生产负载的推理模型。这几个词连起来,说的是同一件事——它是给你拿去干活的,不是拿去聊天的。
104 万上下文和 13 万单次输出这组数字,落到实际操作上是这样的:一个中型项目的全部源码加上依赖说明,通常几十万 token 就装得下,意味着你不用再写切片逻辑、不用再维护「哪几个文件一起喂」的启发式规则,整个塞进去让它自己找。13 万的输出上限则决定了它能不能一次把一个大文件重写完——很多模型卡的不是理解,是写到一半被输出上限截断,你还得拼接。这两项凑齐,长程改代码这件事才算真的能跑。
| 运行指标 | 实测值 | 口径 |
|---|---|---|
| 吞吐 | 24 token/秒 | P50,全平台最优 |
| 延迟 | 5.14 秒 | P50,最优提供方 |
| 3 日在线率 | 100.00% | 至少一个提供方在响应 |
| 3 日可用率 | 99.45% | 推理被成功服务的时间占比 |
| 提供方数量 | 1 家 | 单一托管,OpenRouter 不做路由选择 |
※ 数据来自 OpenRouter 模型页 2026-08-24 显示值。24 token/秒是平台侧统计,不是我本机实测。
▍🧾 代价:它自己写在第一段

页面顶部那段横幅,原文是这么写的:请求与回复由提供方留存,不用于训练,其余用途适用「隐身模型条款」。翻译成人话——能确认的只有“留着”,不用于训练是它的声明,除此之外拿去做什么,你只能推断。
再看身份字段的处理方式。`hugging_face_id` 是空,`knowledge_cutoff` 是空,`tokenizer` 写的是 `Other`。这三个字段平时是拿来做技术溯源的——你能靠它们判断这模型是谁家的底座、训练数据截到哪天。它们不是“还没来得及填”,是被逐个抹平的。匿名做到这个颗粒度,是设计,不是疏忽。
顺带说个判断免费入口的经验。当年大家看一个接口还能不能用,是去翻文档;后来都学乖了,改成直接发一个请求看报错码。原因很简单:文档是去年写的,报错是今天返回的。Ox Alpha 这种情况更要这么看——它的免费期按官方口径只有一周左右,什么时候切断、切断后是什么价,页面上一个字都没写。你的脚本得能扛住某天早上突然收到计费错误或者 404。
▍📈 两天冲上第一:谁在喂它

OpenRouter 会公开每个模型的应用榜。Ox Alpha 上面排第一的是 Hermes Agent,第二是 Claude Code——两个都是长任务型的编程 agent,不是聊天前端。这个组合本身就说明了它被拿去干什么:不是问答,是让它连续干几十分钟的活。
| 应用 | 8 月 23 日 | 8 月 24 日 | 一天变化 |
|---|---|---|---|
| Hermes Agent | 1.2T token | 2.25T token | 接近翻倍 |
| Claude Code | 615B token | 1.11T token | 接近翻倍 |
※ 8 月 23 日数值取自当日抓取的应用榜截图,8 月 24 日为本文发稿前实取。T = 万亿,B = 十亿。
一天之内两个头部应用的用量都接近翻倍——免费又能干活,开发者是很诚实的。但反过来看也成立:这条曲线越陡,提供方拿到的真实生产数据就越多。免费期设成一周左右,正好够跑出一轮完整的使用画像。
这条曲线让我又想起《牛来》。那部片子的传播动力不是“它好看”,是“大家都在看,我不能只有我一个人不知道”。Ox Alpha 也一样:开发者涌进来的第一动机是“免费的前沿模型,先囤上再说”,而不是“我评估完觉得它最合适”。围观驱动的曲线涨得快,但它测出来的是好奇心,不是长期偏好——真正的评价要等收费之后才看得出来。
▍💰 谁赚、谁亏、谁不说话
谁赚:提供方。它花的是推理成本,换回来的是几万亿 token 的真实生产提示词——这批数据在公开市场上买不到,因为没人会把自己的生产代码卖给你。免费期的每一次调用,都是它在收集一份别处买不来的样本。
谁省:开发者。104 万上下文加长任务能力,按主流前沿模型的价目算,跑满一周不是小数字。这笔钱现在是零。谁沉默:提供方自己。它不说自己是谁,不说模型底座是什么,不说留存下来的数据要保存多久、存在哪个司法辖区。沉默的地方往往才是结论。
它为什么现在做这件事、图什么——看它给自己贴的标签就够了:编程、长程 agent、生产负载。这三个词对应的是当下推理消耗最凶、也最愿意付钱的那批用户。它抢的是这批人的入口:先用免费把真实工作流拿到手,等定价的时候你已经改不动流水线了。顺序是想清楚了的,不是随手发一个模型出来看看反响。
还有一条能佐证动机的细节:免费期设的是一周左右,不是一个月,也不是永久。一周刚好够跑完一轮完整的使用画像,又短到你来不及把它当成基础设施。这不像在做慈善,更像在做一次有明确采集窗口的田野调查。
▍🛰️ 说个我自己的事:我的采集管道漏了它三天
我有一条每天早上七点跑的选题采集管道,专门盯 AI 圈的新东西。Ox Alpha 8 月 20 日上线,而我的管道 8 月 20 日选了 Codex 历史记录的开源替代,8 月 21 日选了 llama.cpp 改版本号,8 月 22 日选了 OpenAI 开源 Codex 引擎。它整整三天没看见这个模型。

查完根因我有点服气,因为漏得非常合理。我的模型发布信源一共 12 条:六家大厂的官方博客 RSS,四个写死的 GitHub 仓库 Release,两家科技媒体。这 12 条源的共同前提是“某个已知厂商发布了什么”——而 Ox Alpha 没有厂商。它对我的信源天然不可见,不是抓失败,是压根不在视野里。早在这套信源表建起来的时候,模型发布就等于开发布会加传权重,那时候这个假设是成立的;现在不成立了,表却没改。
第二个原因更具体。我确实在抓 OpenRouter,但判据只有一行:模型 id 里含不含 `:free`。我刚才实测了一遍——在册 422 个模型里定价全零的有 22 个,带 `:free` 后缀的只有 18 个,剩下 4 个被这行判据直接跳过,`stealth/ox-alpha` 就在里面。判据把“免费”和“名字里写了 free”划了等号,而这个模型是零定价但不带后缀。
▍🧭 要不要用,怎么用
值得试,前提是分清楚喂什么。它的规格是真的:104 万上下文、13 万输出、能读图能读视频、支持函数调用,这几项凑齐的免费模型目前没有第二个。免费期按官方口径是一周左右,什么时候结束、结束后什么价,页面上没说。
| 你想干的事 | 建议 | 为什么 |
|---|---|---|
| 读超长代码库、跨文件重构 | 可以用 | 104 万上下文 + 13 万单次输出,切片成本省掉 |
| 长程 agent、跑几十分钟的任务 | 可以用 | 它自己就是按这个定位做的,榜首两个应用都是这类 |
| 带图带视频的理解任务 | 可以用 | 三模态输入,同价位没有替代 |
| 公司代码、客户数据、密钥 | 别碰 | 留存写在明面上,且提供方匿名,出事找不到人 |
| 当长期主力接进生产 | 先别 | 免费期约一周,之后定价未知,单一提供方无冗余 |
还有一条容易被忽略的风险:它只有一家提供方在托管,OpenRouter 页面上明写着不做路由选择。平常多提供方的模型某一家挂了会自动切走,它没有这个退路——这三天的可用率是 99.45%,不是 100%。真接进流水线的话,得自己准备一条降级路径,别让整条链路吊在一个匿名提供方身上。
上手路径很短:在 OpenRouter 注册拿一个免费 API Key,模型 id 填 `stealth/ox-alpha`,接口是 OpenAI 兼容格式,任何支持自定义 base URL 的客户端直接就能用。要接编程 agent 的话,榜单上那两个应用已经替你验证过它扛不扛得住长任务了。
最后回到开头那个对照。《牛来》最出圈的一句反讽是“国漫之光,AI 都写不出”——网友用它调侃那种笨拙到无法被复制的手工感。有意思的是,这个八月和它并排爆红的另一个无名之辈,恰恰就是一个 AI。一个靠“粗糙到不像机器做的”出圈,一个靠“好用到不知道是谁做的”出圈,中间隔着的是同一件事:我们越来越习惯先围观,再判断。
▍📚 数据来源与复现入口
- OpenRouter · Ox Alpha 模型页:https://openrouter.ai/stealth/ox-alpha
- OpenRouter 模型列表 API(本文数据来源):https://openrouter.ai/api/v1/models
- 零度解说的实测视频(2026-08-22):https://www.youtube.com/watch?v=yhhyFO6hSTs
