Ox Alpha:免费隐身编码模型,以及在 MeshCode 中的用法
8月20日,一个名为 ox-alpha 的前沿级模型以免费($0)姿态出现在 OpenRouter 上。没有实验室、没有论文,上下文高达 100 万 token。本文整理目前已确认的事实,以及在 MeshCode 中立即上手的方法。
2026 年 8 月 20 日,一个前沿级模型出现在 OpenRouter 上:没有背后的实验室、没有发布公告、没有系统卡,而价格是输入输出一律**$0**。它叫 ox-alpha,截至本文撰写仍然免费——这可能是这个月编码智能体领域最有趣的一件事。
本文整理目前已确认的事实、仍属传闻的部分,以及在 MeshCode 中一分钟上手的方法。
ox-alpha 的已确认规格
拨开谜团,公开的事实其实很简单:
- 100 万 token 上下文窗口(约 1,048,576),输出最高 131,072 token。足以把整个大型代码库一次性装进对话。
- 为编码与长时间智能体工作打造的推理模型 — OpenRouter 官方描述是"为 coding、sustained agentic work 和 production workloads 而设计",意思就是:长会话、真实工具调用、真实代码。
- 多模态输入 — 文本、图片、视频输入,文本输出。支持工具/函数调用;支持 JSON 输出但不强制 schema。
- 免费 — OpenRouter 的 FAQ 写得很明白:预览期间 prompt 与 completion token 均不计费。上线以来吞吐约 21 tok/s,可用率 100%。
- prompt 会被供应商保留 — 但按公开条款,不会用于训练。
最后这两条值得读两遍。免费、保留、不用于训练——非常适合做实验和大规模并行任务;但在把生产环境密钥贴进去之前,值得想一下。
接入你已经付费的 Claude 或 Codex,其余交给成本只有零头的工作模型。
下载 meshcode →性能到底如何,说实话
早期流传"ox-alpha 在 DeepSWE 上超过 80%,击败 Claude Fable 5 和 GPT-5.6 Sol"的说法。那个数字来自10 个任务的样本——作者本人都提醒过方差很大。113 个任务的完整跑分收敛在 58–63% 区间:与 DeepSeek V4 Pro 同档,低于 max reasoning 下约 73% 的 GPT-5.6 Sol。另外,约 10% 的失分并非推理失败,而是工具调用格式失败——这类"管道问题"通常改善得很快。
对一个零成本的模型来说,这仍是相当强的成绩。它不是神秘的超级智能,而是一个保持开发者匿名的前沿附近水平的编码模型,恰好免费开放。智能体编码的本质就是跑大量长会话和并行任务,所以"前沿中游 + $0"比"遥遥领先的第一名"更有实际意义。
谁做的?没人知道
身份追踪占了这故事的一半。Google、小米、DeepSeek、微软 MAI 都被点名过,但在所有归一化测试中都吻合的**分词器指纹(tokenizer fingerprinting)**证据指向的最有力猜测是:智谱 Zhipu AI / Z.ai 的 GLM-5.3 系列。Z.ai 之前就用"Pony Alpha"之名匿名预览过模型,剧本对得上。
不过如果这个猜测成立,有一点要注意:智谱 AI 在美国商务部实体清单上,有些团队会因此重新考虑代码和 prompt 流向何处。这些都没有定论——官方口径只有一句"开发者选择在预览期间保持匿名",身份传闻请一律按"有力推测"对待。
陷阱:免费预览会结束
没有公布截止日。发布时的报道估计免费窗口可能在 8 月 24–27 日之间关闭,而截稿时仍是 $0。但"未公布截止日"不等于"没有截止日"。想评估 ox-alpha,趁 token 还免费的现在就是时机。
条款的另一半也要读完:OpenRouter 免费档有限流——每分钟 20 个请求,无额度账号每天 50 个请求(购买 $10 以上额度后为每天 1,000 个)。做智能体工作会被推向"更少、更长的会话"——而这正是 MeshCode 窗格擅长的用法。
在 MeshCode 中运行 ox-alpha
MeshCode 内置 OpenRouter 集成——一个开关,418 个模型。ox-alpha 是一等公民。
- 设置 → Models,打开 OpenRouter。
- 粘贴 OpenRouter API Key,点击 Use OpenRouter(免费的 OpenRouter 账号就够——ox-alpha 不计费,不消耗额度)。
- 在模型选择器中选
stealth/ox-alpha。它会出现在窗口底部的输入框徽标上,所有窗格都以它为准。 - **下达任务。**每个窗格实时流式显示智能体的 thinking、工具调用和命令输出,仪表上还有上下文用量。
100 万 token 上下文与 MeshCode 的基本前提——多个智能体、多个项目、一个窗口——尤其合拍。
这才是真正的解锁点。并行跑四个前沿级智能体,过去是预算决策;在免费的百万上下文模型上,这只是寻常的一天。每个微服务开一个窗格,最老的仓库交给清理智能体,第五个跑迁移智能体——把高级模型留给真正需要它的部分。
延伸阅读
- ox-alpha 是谁做的?线索全整理 — 分词器指纹、Pony Alpha 前例,以及站不住脚的理论。
- ox-alpha 基准测试:数字真正说明了什么 — 80% 传闻 vs 完整跑分。
- OpenRouter 免费编码模型总整理(2026 年 8 月) — $0 的不止 ox-alpha,关键是限流规则。
开始使用
这么便宜的隐身模型不常出现,也不会永远免费。下载 MeshCode,打开 OpenRouter,选上 stealth/ox-alpha,有多少个项目,就开多少个窗格来用这一百万 token 的上下文。
ox-alpha 由匿名第三方开发,经 OpenRouter 分发。以上内容基于截至 2026 年 8 月 26 日的 OpenRouter 页面与独立社区报道,可能随预览进展或身份确认而变化。MeshCode 与该模型开发者及 OpenRouter 无隶属或背书关系。