不知道谁家的 AI 模型,免费送 100 万上下文,我用 Hermes 把它接上了
不知道谁家的 AI 模型,免费送 100 万上下文,我用 Hermes 把它接上了 最近 AI 圈有个挺有意思的现象:各家大模型发布会越开越隆重,参数越吹越大,可真正让人上头的,反而是几个“查无此人”的匿名模型。 8 月 20 日,OpenRouter 上悄悄冒出来一个叫 OxAlpha 的模型
💡 你将学到
不知道谁家的 AI 模型,免费送 100 万上下文,我用 Hermes 把它接上了 最近 AI 圈有个挺有意思的现象:各家大模型发布会越开越隆重,参数越吹越大,可真正让人上头的,反而是几个“查无此人”的匿名模型。 8 月 20 日,OpenRouter 上悄悄冒出来一个叫 OxAlpha 的模型
不知道谁家的 AI 模型,免费送 100 万上下文,我用 Hermes 把它接上了
最近 AI 圈有个挺有意思的现象:各家大模型发布会越开越隆重,参数越吹越大,可真正让人上头的,反而是几个“查无此人”的匿名模型。
8 月 20 日,OpenRouter 上悄悄冒出来一个叫 OxAlpha 的模型。没有官方公告,没有模型卡,连开发方是谁都不知道,提供商那一栏就写着俩字——匿名。
按理说这种来路不明的模型大家应该绕着走。结果呢?上线不到一周,它在 OpenCode 平台的用量榜冲到了第 3 名,一周吃掉 7.1 万亿 token,占全平台流量的 2%。排在它前面的,一个是 DeepSeek V4 Flash,一个是小米 MiMo——全是正经有名字的大厂模型。
参数表有多离谱(免费)
我第一次点开它的参数页的时候愣了一下:
| 项目 | Ox Alpha |
|---|---|
| 上下文 | 1,048,576 Token / 1M |
| 最大输出 | 131,072 Token |
| 输入 | 文本 / 图片 / 视频 |
| 推理 | 强制开启 |
| 当前价格 | 免费 |
1M 上下文是什么概念?差不多能一次塞进一整个中型代码库,或者一本 30 万字的长篇小说。目前市面上带 1M 上下文的模型,比如 DeepSeek V4 Pro,输入输出加起来每百万 token 要收两三块钱。OxAlpha 直接标了个 0。
更少见的是视频输入。现在支持“看视频”的模型一只手数得过来,大部分免费模型连图片都未必带。再加上推理强制开启——这个模型每次回答都会先深度思考一轮,属于“想得慢但想得深”的类型。
它到底是谁家的(没人知道)
这就是 OxAlpha 最有意思的地方了。
它是典型的"stealth"(匿名预览)模型:某个大厂把没发布的新模型挂到 API 平台上,收集真实用户的反馈,等反馈攒够了再正式官宣。过去半年这种玩法出现过 4 次,事后扒出来全部来自中国的大模型团队。
这次社区的侦探们也很快行动了。有人测试 tokenizer(模型的分词器,相当于指纹),有人盯着 API 报错码,最后发现一个 Z.AI 特有的报错格式——最大嫌疑指向智谱的 GLM-5.3 变体。但截至我写这篇文章,没有任何一方出来认领。
实测口碑也挺分裂。有人拿它在 Claude Code 里一口气生成了完整的星舰模拟页面,评价是“这模型想得太多了,但产出确实能打”;也有开发者 Bindu Reddy 实测完直接说它“空转严重”,能力接近两代前的旧模型。跑分就更矛盾了,一份第三方测试给它平均 80% 的成绩,另一份把它排到末位。我的建议是别信任何单方说法,自己上手试试最实在。
我是怎么接入的(三步)
作为一个天天跟 Hermes Agent 打交道的人,当然要第一时间把它接进自己的工作流。整个过程比想象中简单:
第一步,去 OpenRouter 官网注册,生成一个 API Key;
第二步,把 Key 写进 Hermes 的 .env 配置文件;
第三步,在 config.yaml 里把默认模型改成 stealth/ox-alpha,重启就能用了。
# ~/.hermes/.env
OPENROUTER_API_KEY=***
# ~/.hermes/config.yaml
model:
provider: openrouter
default: stealth/ox-alpha
1M 上下文配 Agent 是真的舒服。平时让 Hermes 分析一个大项目,光是把代码喂进去就要精打细算 token,现在可以直接把整个仓库丢进去慢慢聊,不用再操心上下文爆掉的问题。
白嫖之前,先记住这两件事
第一,窗口期很短。免费预览从 8 月 20 日开始,官方说只持续一周左右,之后的价格和限流都还没公布。前几个 stealth 模型都在几天内被揭开了面纱,OxAlpha 的真身估计也快揭晓了,想体验的抓紧。
第二,别喂敏感数据。平台承诺预览期零数据留存,但这毕竟是厂商的单方面声明,没有经过独立验证。密码、个人隐私、公司的商业代码,这几样无论什么时候都别往匿名模型里放。
我一直奉劝身边的朋友:白嫖可以,脑子要在线。
说起来也有点感慨,一年前我们还在为百万上下文的天价账单咋舌,现在一个连名字都不敢报的模型,直接把这个门槛踩平了送上门。
在 2026 年的今天,你还在为长上下文的 token 费心疼吗?评论区聊聊。
本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。
