
Darmowe modele do kodowania na OpenRouter (sierpień 2026): Ox Alpha i 7 innych wartych Twoich zapytań
Ox-alpha przoduje teraz w darmowej kolekcji OpenRouter, ale nie jest sam — Kimi K2.6, gpt-oss-120b, Nemotron 3 Ultra i więcej. Plus limity szybkości (20/min, 50/dzień), które faktycznie decydują, co możesz zbudować za $0.
Krótka odpowiedź: tak, możesz uruchomić prawdziwego agenta do kodowania za $0 już teraz. Ox-alpha — anonimowy model typu stealth z oknem kontekstu 1M — jest gwiazdą, a towarzyszy mu głęboka ława modeli open-weight. Haczyk nie leży w modelach; leży w limitach szybkości. Oto pełne pole i jak faktycznie na nim budować.
Darmowe pole, sierpień 2026
| Model | Kontekst | Najlepszy do |
|---|---|---|
| Ox Alpha (stealth) | 1M | Rozumowanie, długodystansowe kodowanie agentowe — darmowy w czasie podglądu |
| Kimi K2.6 (Moonshot AI) | 262K | Najsilniejszy darmowy agentowy koder open-weight (47,6% na CursorBench 3.1) |
| NVIDIA Nemotron 3 Ultra | 1M | Długie workflow agentowe; hybrydowy MoE Mamba-Transformer |
| Poolside Laguna S 2.1 / M.1 | 262K | Kodowanie terminalowe/agentowe; 70,2% Terminal-Bench 2.1; open-weight |
| Cohere North Mini Code | 256K | Zadania typu agent-harness; 30B MoE, Apache 2.0 |
| OpenAI gpt-oss-120b | 131K | Solidny generalista open-weight |
| MiniMax M3 | — | Kodowanie + użycie narzędzi, wysiłek rozumowania high/xhigh |
Jedna nieobecność warta odnotowania: Qwen3 Coder 480B (kontekst 1M), długoletni darmowy faworyt, został oznaczony do wycofania około 19 lipca — przypomnienie, że ten krajobraz przetasowuje się bez ostrzeżenia.
Podłącz Claude lub Codex, za które już płacisz — resztę zrobią workery kosztujące ułamek ceny.
Pobierz meshcode →Limity szybkości, które faktycznie o wszystkim decydują
Darmowe na OpenRouter nie znaczy nieograniczone. Opublikowane limity darmowego poziomu:
- 20 żądań/minutę na modelach
:free - 50 żądań/dzień na koncie bez kredytów
- 1000 żądań/dzień po zakupie $10+ w kredytach (jednorazowo, a kredyty są Twoje do wydania)
Dwie dźwignie, które większość ludzi przeocza:
openrouter/freeto auto-router: skieruj tam swojego agenta, a wybierze dowolny darmowy model spełniający potrzeby żądania (wywołania narzędzi, wejście obrazu, ustrukturyzowany wynik).:freedodane do ID modelu przypina darmowy endpoint tego modelu, np. dla Kimi K2.6.
Zróbmy matematykę dla pracy agentowej: 50 żądań dziennie znika w około dziesięć minut gadatliwej pętli agenta. Przy 1000/dzień znów budżetujesz — tylko przy bardzo innym punkcie cenowym.
Jak budować za $0, nie walcząc z licznikiem
Zespoły uzyskujące realną pracę z darmowych modeli dzielą ten sam kształt:
- Mniej, dłuższe sesje. Model z kontekstem 1M, jak ox-alpha czy Nemotron 3 Ultra, potrafi utrzymać całą sesję roboczą w jednej rozmowie. Każdy ponowny odczyt kontekstu, którego unikasz, to zaoszczędzone żądanie.
- Równoległe panele, nie sekwencyjne pętle. Rozdziel pracę między agentów — jeden na usługę, na repo, na zadanie — zamiast jednego agenta wykonującego setki wywołań. Cztery panele po 20 żądań/min każdy biją jednego agenta młócącego o pułap.
- Zachowaj model premium na trudne 10%. Darmowe modele obsługują większość; skieruj pokraczne debugowanie do modelu najwyższej klasy, gdy jest to faktycznie uzasadnione.
Uruchamianie ich w MeshCode
Integracja OpenRouter w MeshCode chowa wszystko powyższe za jednym przełącznikiem: Ustawienia → Modele → OpenRouter, wklej swój klucz i wybierz modele z selektora 418 modeli — ox-alpha włącznie. Każdy panel uruchamia własnego agenta i własny model, więc możesz postawić ox-alpha na trzech panelach, Kimi K2.6 na czwartym, i zachować Claude na te części, które go potrzebują. Pełny przewodnik w Ox Alpha: darmowy model stealth do kodowania.
Szczere zastrzeżenie: darmowe endpointy to ruchoma podłoga. Modele są wycofywane, podglądy się kończą, opóźnienia skaczą w szczycie. Traktuj $0 jako sposób, żeby testować więcej, rozgałęziać się szerzej i uczyć się szybciej — nie jako architekturę produkcyjną.
Dostępność darmowych modeli i limity według opublikowanej dokumentacji OpenRouter na dzień 26 sierpnia 2026 roku, mogą ulec zmianie. MeshCode nie jest powiązany z OpenRouter ani z wymienionymi dostawcami modeli.
Więcej na blogu
GPT-6 Astra mówi, że osiągnąłeś limit? Co zrobić teraz
Właśnie trafiłeś na komunikat o limicie użycia Astra w środku zadania. Oto praktyczna sekwencja działań, żeby dziś odblokować pracę, nie tracąc postępu i nie ponawiając prób coraz głębiej w dół.
Limit użycia GPT-6 Astra wyjaśniony: pułapy czatu, limity Codex i błędy 429 API
Limity GPT-6 Astra pojawiają się w trzech różnych systemach — pułapach planu ChatGPT, limitach Codex i limitach API — i każdy zawodzi inaczej. Oto co naprawdę oznaczają komunikaty i co zrobić w przypadku każdego z nich.
Limit użycia Gemini wyjaśniony: darmowy poziom, AI Pro i dlaczego limity nie są jedną liczbą
Limity użycia Gemini działają inaczej w CLI, w API i w subskrypcjach Google AI — liczniki zapytań, nie budżety tokenów. Oto, co limity tak naprawdę oznaczają i co zrobić, gdy na któryś natrafisz.