//Risorse2 min di lettura
OmniRoute, gateway open-source che aggrega 90+ free tier AI in un unico endpoint per coding agent

In breve: OmniRoute è un gateway AI locale e open-source (MIT) che raccoglie 290 provider, di cui oltre 90 con free tier, in un singolo endpoint OpenAI-compatibile. Si installa con npm, gira sulla propria macchina e evita di dover gestire decine di API key e rate limit separati quando si usano coding agent come Claude Code, Codex CLI o OpenCode.
Chi usa coding agent con modelli gratuiti lo sa: ogni provider ha il suo SDK, i suoi limiti, la sua dashboard. L'idea di OmniRoute è semplice: mettere in comune i free tier documentati di 43 pool di provider (516 modelli) ed esporli su localhost:20128/v1. Il progetto stima circa 1,53 miliardi di token gratuiti al mese sommando tutte le quote disponibili, ricalcolate ogni due settimane contro il catalogo live.
Setup in tre passaggi
```bash
npm install -g omniroute
omniroute
```
- La dashboard si apre su
http://localhost:20128 - Si collega un provider gratuito (Pollinations non richiede nemmeno la key, OpenCode Free è senza autenticazione)
- Nel coding agent si imposta Base URL
http://localhost:20128/v1e modelloauto
Il routing automatico valuta 12 fattori (tra cui salute, quota, costo e latenza) e sceglie il provider migliore. Se una quota si esaurisce, il fallback passa al successivo in millisecondi.
Oltre al routing
- Compressione token RTK + Caveman: il progetto riporta risparmi dal 15% al 95% a seconda della sessione (media ~89% su output tool-heavy)
- Resilienza a 3 layer: circuit breaker per provider, cooldown per connessione, lockout per modello
- MCP server con 104 tool e A2A server con 6 skill
- Gira anche con Docker, su ARM/Raspberry Pi, via Termux su Android e come PWA
Alcuni provider gratuiti che vale la pena guardare
| Provider | Modelli | Quota |
|:-|:-|:-|
| Pollinations | GPT-5, Claude, Llama 4 | Nessuna key richiesta |
| Qoder | Kimi-K2, DeepSeek-R1 | Illimitato |
| Kiro | Claude Sonnet 4.5, Haiku 4.5, Opus 4.6 | 50 crediti/mese |
| Cerebras | Qwen3 235B, GPT-OSS 120B | 1M token/giorno |
| NVIDIA NIM | 129 modelli | ~40 RPM |
| Cloudflare AI | 50+ modelli | 10K neurons/giorno |
Cosa tenere presente
- Il progetto è partito a febbraio 2026: molto attivo (oltre 33k star, 360+ contributori, 5.900+ commit) ma giovane, con rischio di breaking changes
- I free tier restano soggetti ai rate limit dei singoli provider: non è "illimitato" in senso assoluto
- Il traffico passa comunque da server terzi, a meno di usare provider locali (Ollama, LM Studio)
- Richiede Node.js 22.22.2 o superiore
- Il numero da 1,53B token/mese è la somma di tutte le quote, non una disponibilità singola
Fonti
- GitHub - diegosouzapw/OmniRoute
- Sito ufficiale
- npm - omniroute
Chi lo sta usando con Claude Code, Codex o OpenCode? Come vi trovate con il fallback automatico?
📌 Questo articolo riassume una discussione su r/vibecodingitalia. Leggi il post originale.

Scritto da
Michael Gasperini@TheStreamCode
Full Stack Developer
Creatore di Vibe Coding Italia, la community italiana sull’intelligenza artificiale. Progetta e sviluppa prodotti con l’AI e ne racconta l’applicazione pratica attraverso guide e articoli.
GLM-5.3-Flash: il modello stealth Ox Alpha è ufficialmente Z.ai, ora in competizione con DeepSeek V4 Flash
Z.ai rivela che Ox Alpha era GLM-5.3-Flash: 320B/18B MoE multimodale open source (MIT) con attenzione ibrida, prezzi scontati su OpenRouter fino al 9 settembre.
Leggi articoloCharm Hyper: inferenza per agenti di coding, 100 crediti gratis al mese
Charm lancia Hyper: inferenza ottimizzata per il coding con catalogo solo-coding (DeepSeek V4 Flash da $0.20/1M), API OpenAI e Anthropic compatibile, 100 crediti gratis al mese e zero data retention.
Leggi articoloDeepSeek ha rilasciato il suo harness open source: tutto è un plugin
DeepSeek Harness è il nuovo harness open source di DeepSeek per coding agent: architettura a plugin su Cordis, licenza MIT, modelli e tool intercambiabili.
Leggi articolo



