OpenRouter 免費編碼模型盤點(2026 年 8 月):Ox Alpha 與另外 7 個值得用的
Ox-alpha 目前領跑 OpenRouter 免費專區,但它並不孤單——還有 Kimi K2.6、gpt-oss-120b、Nemotron 3 Ultra 等。以及真正決定你能在 $0 上架什麼的速率限制(每分鐘 20 次、每天 50 次)。
簡短回答:可以,現在就能在 $0 上跑一個真正的編碼代理人。 Ox-alpha——擁有百萬上下文的匿名隱身模型——是頭牌,身後還站著一整排開放權重模型。真正的門檻不是模型,而是速率限制。以下是全部陣容,以及實際怎麼用它蓋東西。
2026 年 8 月的免費陣容
| 模型 | 上下文 | 最擅長 |
|---|---|---|
| Ox Alpha(隱身) | 1M | 推理、長程代理人編程——預覽期免費 |
| Kimi K2.6(月之暗面) | 262K | 最強的免費開放權重代理人編碼器(CursorBench 3.1 上 47.6%) |
| NVIDIA Nemotron 3 Ultra | 1M | 長程代理人工作流;混合 Mamba-Transformer MoE |
| Poolside Laguna S 2.1 / M.1 | 262K | 終端機/代理人編碼;Terminal-Bench 2.1 上 70.2%;開放權重 |
| Cohere North Mini Code | 256K | 代理人框架任務;30B MoE,Apache 2.0 |
| OpenAI gpt-oss-120b | 131K | 可靠的開放權重通用選手 |
| MiniMax M3 | — | 編碼 + 工具呼叫,支援 high/xhigh 推理力度 |
有一個缺席值得點名:長期穩坐免費頭把交椅的 Qwen3 Coder 480B(百萬上下文),已在 7 月 19 日前後被標記除役——提醒我們這片版圖隨時會洗牌。
連接你已經付費的 Claude 或 Codex,其餘交給成本只有零頭的工作模型。
下載 meshcode →真正起決定作用的速率限制
OpenRouter 的免費不等於無限制。公開的免費額度上限:
:free模型每分鐘 20 次請求- 未儲值帳戶每天 50 次請求
- 儲值滿 $10 之後每天 1,000 次(一次性,儲進去的錢還是你的)
大多數人錯過的兩個槓桿:
openrouter/free是自動路由器:把代理人指向它,它會自動挑選能滿足該請求需求(工具呼叫、圖像輸入、結構化輸出)的免費模型。- 在模型 ID 後加
:free可以鎖定該模型的免費端點,比如 Kimi K2.6。
算一筆代理人的帳:一天 50 次請求,一個話多的代理人迴圈約十分鐘就燒完了。到了 1,000/天,你依然要精打細算——只是價格量級完全不同了。
在 $0 上建置而不跟計數器打架
真正從免費模型榨出產出的團隊都是同一個形狀:
- 更少的會話,更長的會話。 像 ox-alpha 或 Nemotron 3 Ultra 這樣的百萬上下文模型能把整個工作會話裝進一段對話裡。省下的每一次上下文重讀,就是省下的一次請求。
- 平行窗格,而不是串行迴圈。 把工作拆給多個代理人——每個服務一個、每個儲存庫一個、每個任務一個——別讓一個代理人打幾百通電話。四個各自每分鐘 20 次的窗格,勝過一個頂著上限硬撞的代理人。
- 把付費模型留給最難的那 10%。 大宗交給免費模型;真正棘手的除錯才路由給前沿模型。
在 MeshCode 裡執行它們
MeshCode 的 OpenRouter 整合把上面這一切收進一個開關:Settings → Models → OpenRouter,貼上金鑰,從 418 個模型的選擇器裡挑——包括 ox-alpha。每個窗格跑自己的代理人和自己的模型:三個窗格放 ox-alpha,第四個放 Kimi K2.6,需要的地方留給 Claude。完整教學見 Ox Alpha:免費隱身編碼模型。
誠實的提醒:免費端點是移動的地板。模型會除役,預覽會結束,尖峰時段延遲會飆。把 $0 當作「測得更多、鋪得更開、學得更快」的手段——而不是正式環境架構。
免費模型的可用性與額度以 2026 年 8 月 26 日 OpenRouter 公開文件為準,可能變動。MeshCode 與 OpenRouter 及所列模型供應商無關聯。