OmniRoute, gateway open-source che aggrega 90+ free tier AI in un unico endpoint per coding agent

In breve: OmniRoute è un gateway AI locale e open-source (MIT) che raccoglie 290 provider, di cui oltre 90 con free tier, in un singolo endpoint OpenAI-compatibile. Si installa con npm, gira sulla propria macchina e evita di dover gestire decine di API key e rate limit separati quando si usano coding agent come Claude Code, Codex CLI o OpenCode.
Chi usa coding agent con modelli gratuiti lo sa: ogni provider ha il suo SDK, i suoi limiti, la sua dashboard. L'idea di OmniRoute è semplice: mettere in comune i free tier documentati di 43 pool di provider (516 modelli) ed esporli su localhost:20128/v1. Il progetto stima circa 1,53 miliardi di token gratuiti al mese sommando tutte le quote disponibili, ricalcolate ogni due settimane contro il catalogo live.
Setup in tre passaggi
```bash
npm install -g omniroute
omniroute
```
- La dashboard si apre su
http://localhost:20128 - Si collega un provider gratuito (Pollinations non richiede nemmeno la key, OpenCode Free è senza autenticazione)
- Nel coding agent si imposta Base URL
http://localhost:20128/v1e modelloauto
Il routing automatico valuta 12 fattori (tra cui salute, quota, costo e latenza) e sceglie il provider migliore. Se una quota si esaurisce, il fallback passa al successivo in millisecondi.
Oltre al routing
- Compressione token RTK + Caveman: il progetto riporta risparmi dal 15% al 95% a seconda della sessione (media ~89% su output tool-heavy)
- Resilienza a 3 layer: circuit breaker per provider, cooldown per connessione, lockout per modello
- MCP server con 104 tool e A2A server con 6 skill
- Gira anche con Docker, su ARM/Raspberry Pi, via Termux su Android e come PWA
Alcuni provider gratuiti che vale la pena guardare
| Provider | Modelli | Quota |
|:-|:-|:-|
| Pollinations | GPT-5, Claude, Llama 4 | Nessuna key richiesta |
| Qoder | Kimi-K2, DeepSeek-R1 | Illimitato |
| Kiro | Claude Sonnet 4.5, Haiku 4.5, Opus 4.6 | 50 crediti/mese |
| Cerebras | Qwen3 235B, GPT-OSS 120B | 1M token/giorno |
| NVIDIA NIM | 129 modelli | ~40 RPM |
| Cloudflare AI | 50+ modelli | 10K neurons/giorno |
Cosa tenere presente
- Il progetto è partito a febbraio 2026: molto attivo (oltre 33k star, 360+ contributori, 5.900+ commit) ma giovane, con rischio di breaking changes
- I free tier restano soggetti ai rate limit dei singoli provider: non è "illimitato" in senso assoluto
- Il traffico passa comunque da server terzi, a meno di usare provider locali (Ollama, LM Studio)
- Richiede Node.js 22.22.2 o superiore
- Il numero da 1,53B token/mese è la somma di tutte le quote, non una disponibilità singola
Fonti
- GitHub - diegosouzapw/OmniRoute
- Sito ufficiale
- npm - omniroute
Chi lo sta usando con Claude Code, Codex o OpenCode? Come vi trovate con il fallback automatico?
📌 Questo articolo riassume una discussione su r/vibecodingitalia. Leggi il post originale.

Scritto da
Michael Gasperini@TheStreamCode
Founder & Sviluppatore
Founder di Vibe Coding Italia, la community italiana sull'intelligenza artificiale. Progetta e sviluppa prodotti con l'AI e ne racconta l'applicazione pratica attraverso guide e articoli.
OpenRouter lancia Fusion: multi-modello in parallelo che compete con Fable a metà prezzo
OpenRouter lancia Fusion: interroga più LLM in parallelo, li fa sintetizzare da un giudice e punta all'intelligenza di Fable 5 a circa metà del costo.
Leggi articoloMiniMax M3 gratis fino al 17 giugno su TokenRouter — e tutti gli altri modelli MiniMax al 50%
MiniMax M3 è gratis su TokenRouter fino al 17 giugno 2026: 1M token di contesto, benchmark top su SWE-Bench Pro e Terminal-Bench. Come accedervi.
Leggi articoloUn esempio di raccolta di leggi italiane disponibile su GitHub, in formato Markdown
Una raccolta di leggi italiane in Markdown mostra perché dati pubblici e formato riusabile non sono la stessa cosa, tra RAG, ricerca e legal tech.
Leggi articolo



