OpenRouter 免费编码模型盘点(2026 年 8 月):Ox Alpha 与另外 7 个值得用的
Ox-alpha 目前领跑 OpenRouter 免费专区,但它并不孤单——还有 Kimi K2.6、gpt-oss-120b、Nemotron 3 Ultra 等。以及真正决定你能在 $0 上搭什么的速率限制(每分钟 20 次、每天 50 次)。
简短回答:可以,现在就能在 $0 上跑一个真正的编码智能体。 Ox-alpha——拥有百万上下文的匿名隐身模型——是头牌,身后还站着一整排开放权重模型。真正的门槛不是模型,而是速率限制。以下是全部阵容,以及实际怎么用它搭东西。
2026 年 8 月的免费阵容
| 模型 | 上下文 | 最擅长 |
|---|---|---|
| Ox Alpha(隐身) | 1M | 推理、长程智能体编程——预览期免费 |
| Kimi K2.6(月之暗面) | 262K | 最强的免费开放权重智能体编码器(CursorBench 3.1 上 47.6%) |
| NVIDIA Nemotron 3 Ultra | 1M | 长程智能体工作流;混合 Mamba-Transformer MoE |
| Poolside Laguna S 2.1 / M.1 | 262K | 终端/智能体编码;Terminal-Bench 2.1 上 70.2%;开放权重 |
| Cohere North Mini Code | 256K | 智能体框架任务;30B MoE,Apache 2.0 |
| OpenAI gpt-oss-120b | 131K | 可靠的开放权重通用选手 |
| MiniMax M3 | — | 编码 + 工具调用,支持 high/xhigh 推理力度 |
有一个缺席值得点名:长期稳坐免费头把交椅的 Qwen3 Coder 480B(百万上下文),已在 7 月 19 日前后被标记退役——提醒我们这片版图随时会洗牌。
接入你已经付费的 Claude 或 Codex,其余交给成本只有零头的工作模型。
下载 meshcode →真正起决定作用的速率限制
OpenRouter 的免费不等于无限制。公开的免费档上限:
:free模型每分钟 20 次请求- 无充值账户每天 50 次请求
- 充值满 $10 之后每天 1,000 次(一次性,充进去的钱还是你的)
大多数人错过的两个杠杆:
openrouter/free是自动路由器:把智能体指向它,它会自动挑选能满足该请求需求(工具调用、图像输入、结构化输出)的免费模型。- 在模型 ID 后加
:free可以锁定该模型的免费端点,比如 Kimi K2.6。
算一笔智能体的账:一天 50 次请求,一个话痨智能体循环约十分钟就烧完了。到了 1,000/天,你依然要精打细算——只是价格量级完全不同了。
在 $0 上搭建而不跟计数器打架
真正从免费模型榨出产出的团队都是同一个形状:
- 更少的会话,更长的会话。 像 ox-alpha 或 Nemotron 3 Ultra 这样的百万上下文模型能把整个工作会话装进一段对话里。省下的每一次上下文重读,就是省下的一次请求。
- 并行窗格,而不是串行循环。 把工作拆给多个智能体——每个服务一个、每个仓库一个、每个任务一个——别让一个智能体打几百通电话。四个各自每分钟 20 次的窗格,胜过一个顶着上限硬撞的智能体。
- 把付费模型留给最难的那 10%。 大头交给免费模型;真正棘手的调试才路由给前沿模型。
在 MeshCode 里运行它们
MeshCode 的 OpenRouter 集成把上面这一切收进一个开关:Settings → Models → OpenRouter,粘贴密钥,从418 个模型的选择器里挑——包括 ox-alpha。每个窗格跑自己的智能体和自己的模型:三个窗格放 ox-alpha,第四个放 Kimi K2.6,需要的地方留给 Claude。完整教程见 Ox Alpha:免费隐身编码模型。
诚实的提醒:免费端点是移动的地板。模型会退役,预览会结束,高峰期延时会飙。把 $0 当作"测得更多、铺得更开、学得更快"的手段——而不是生产架构。
免费模型的可用性与限额以 2026 年 8 月 26 日 OpenRouter 公开文档为准,可能变动。MeshCode 与 OpenRouter 及所列模型提供方无关联。