arrow_back 全部文章
2026年8月26日 · 6 分钟阅读 · meshcode

OpenRouter 免费编码模型盘点(2026 年 8 月):Ox Alpha 与另外 7 个值得用的

Ox-alpha 目前领跑 OpenRouter 免费专区,但它并不孤单——还有 Kimi K2.6、gpt-oss-120b、Nemotron 3 Ultra 等。以及真正决定你能在 $0 上搭什么的速率限制(每分钟 20 次、每天 50 次)。

简短回答:可以,现在就能在 $0 上跑一个真正的编码智能体。 Ox-alpha——拥有百万上下文的匿名隐身模型——是头牌,身后还站着一整排开放权重模型。真正的门槛不是模型,而是速率限制。以下是全部阵容,以及实际怎么用它搭东西。

2026 年 8 月的免费阵容

模型 上下文 最擅长
Ox Alpha(隐身) 1M 推理、长程智能体编程——预览期免费
Kimi K2.6(月之暗面) 262K 最强的免费开放权重智能体编码器(CursorBench 3.1 上 47.6%)
NVIDIA Nemotron 3 Ultra 1M 长程智能体工作流;混合 Mamba-Transformer MoE
Poolside Laguna S 2.1 / M.1 262K 终端/智能体编码;Terminal-Bench 2.1 上 70.2%;开放权重
Cohere North Mini Code 256K 智能体框架任务;30B MoE,Apache 2.0
OpenAI gpt-oss-120b 131K 可靠的开放权重通用选手
MiniMax M3 编码 + 工具调用,支持 high/xhigh 推理力度

有一个缺席值得点名:长期稳坐免费头把交椅的 Qwen3 Coder 480B(百万上下文),已在 7 月 19 日前后被标记退役——提醒我们这片版图随时会洗牌。

接入你已经付费的 Claude 或 Codex,其余交给成本只有零头的工作模型。

下载 meshcode →

真正起决定作用的速率限制

OpenRouter 的免费不等于无限制。公开的免费档上限:

  • :free 模型每分钟 20 次请求
  • 无充值账户每天 50 次请求
  • 充值满 $10 之后每天 1,000 次(一次性,充进去的钱还是你的)

大多数人错过的两个杠杆:

  • openrouter/free 是自动路由器:把智能体指向它,它会自动挑选能满足该请求需求(工具调用、图像输入、结构化输出)的免费模型。
  • 在模型 ID 后加 :free 可以锁定该模型的免费端点,比如 Kimi K2.6。

算一笔智能体的账:一天 50 次请求,一个话痨智能体循环约十分钟就烧完了。到了 1,000/天,你依然要精打细算——只是价格量级完全不同了。

在 $0 上搭建而不跟计数器打架

真正从免费模型榨出产出的团队都是同一个形状:

  1. 更少的会话,更长的会话。 像 ox-alpha 或 Nemotron 3 Ultra 这样的百万上下文模型能把整个工作会话装进一段对话里。省下的每一次上下文重读,就是省下的一次请求。
  2. 并行窗格,而不是串行循环。 把工作拆给多个智能体——每个服务一个、每个仓库一个、每个任务一个——别让一个智能体打几百通电话。四个各自每分钟 20 次的窗格,胜过一个顶着上限硬撞的智能体。
  3. 把付费模型留给最难的那 10%。 大头交给免费模型;真正棘手的调试才路由给前沿模型。

在 MeshCode 里运行它们

MeshCode 的 OpenRouter 集成把上面这一切收进一个开关:Settings → Models → OpenRouter,粘贴密钥,从418 个模型的选择器里挑——包括 ox-alpha。每个窗格跑自己的智能体和自己的模型:三个窗格放 ox-alpha,第四个放 Kimi K2.6,需要的地方留给 Claude。完整教程见 Ox Alpha:免费隐身编码模型

诚实的提醒:免费端点是移动的地板。模型会退役,预览会结束,高峰期延时会飙。把 $0 当作"测得更多、铺得更开、学得更快"的手段——而不是生产架构。


免费模型的可用性与限额以 2026 年 8 月 26 日 OpenRouter 公开文档为准,可能变动。MeshCode 与 OpenRouter 及所列模型提供方无关联。

OpenRouter免费模型ox-alphaKimi K2.6gpt-oss编码智能体免费 AI 编程