AI Router · un endpoint OpenAI-compatibile · ogni richiesta al modello giusto · fino al 90% di spesa in meno · 500 crediti di benvenuto · nessuna carta richiesta
AI Router · un endpoint OpenAI-compatibile · ogni richiesta al modello giusto · fino al 90% di spesa in meno · 500 crediti di benvenuto · nessuna carta richiesta
airouter
simple · 1 credito
0,9 s ✓
moderate · 3 crediti
1,8 s
complex · 5 crediti
3,4 s
classificazione · 0 crediti
120 ms ✓
API v1 · streaming SSE su tutte le superfici

Una riga di codice.
Tutti i modelli.
Fino al 90% in meno.

Paghi un modello di frontiera anche per un «ciao»? AI Router legge ogni richiesta, capisce quanto è difficile e la manda al modello giusto — tra Gemini, Qwen, Claude e GPT. Cambi il base_url e sei operativo.

richiesta · 18 ms · TLS · instradata
POST /v1/chat/completions
classificata · livello simple
instradata · 1 credito
airouter.it/app/logs
richiesta
AR
airouter-auto · ultimi 60 minuti
1.284 richieste · 4 provider
Instradamento
88%
richiesta · classificata
{ }"Scrivimi un test per questa funzione" → categoria coding, livello simple. Modello scelto gemini-flash
instradamento in corso…
RICHIESTE
1.284
RISPARMIO
68%
LATENZA
1,4s
mittente · la tua app · SDK OpenAI
AI
Assistente · la tua app
gemini-flash · simple
oggi · 14:08
Ciao! Mi scrivi un test per questa funzione?
14:08
Certo — parto dai casi limite.
14:08 · adesso
Ecco la funzione in Python, con i test 👇
14:08 · adesso
Fatto: tre test verdi, zero regressioni.
14:09 · adesso
Perfetto, grazie 🙌
14:09 ✓✓
Scrivi un messaggio…
3 risposte
adesso
destinatario · risposta · 1 credito
LIVE
{ } ✓✓
90% spesa in meno
·
3 livelli
·
20 preset pronti
·
0 cr per classificare
10 famiglie di modelli
un endpoint per tutte
OpenAI ANTHROPIC google gemini // meta llama QWEN Mistral DeepSeek xAI Cohere. NVIDIA
OpenAI ANTHROPIC google gemini // meta llama QWEN Mistral DeepSeek xAI Cohere. NVIDIA
— Manifesto

Un solo endpoint
batte
dieci SDK.

«Abbiamo smesso di scegliere il modello a mano. Lo sceglie la richiesta.»

AR
Il team AI Router
airouter.it · Italia
dal 2026 API v1

La maggior parte delle richieste non ha bisogno del modello più costoso — ma il codice lo chiama lo stesso, perché cambiarlo caso per caso è lavoro. Abbiamo messo quella decisione dentro l'endpoint: la richiesta viene letta, classificata e instradata al modello più economico che sa rispondere. Una chiave, una fattura, un log solo.

1
endpoint · tutti i provider
0
crediti per classificare
3
livelli · 1 · 3 · 5 crediti
01
Funzione uno
Classificazione e instradamento
3 livelli· classificare costa 0· alias di categoria· override manuale

Ogni richiesta al modello più economico
che sa davvero rispondere.

Un classificatore leggero legge la richiesta e decide il livello: Simple, Moderate o Complex. Il router sceglie il modello più efficiente per quel livello, anche tra provider diversi. Tu continui a chiamare un solo nome di modello — e la decisione finisce nel log, non in un'ipotesi.

AR
airouter-auto · ultimi 60 minuti
1.284 richieste · 3 livelli · 4 provider
Instradamento
88%
livello: simple categoria: coding provider: gemini stream: on fallback: pronto
SIMPLE
71%
MODERATE
22%
COMPLEX
7%
CREDITI
1,4
RISPARMIO
68%
Simple · gemini-flash scelto
1 credito · 0,9 s · risposta completa
Complex · modello premium scartato
5 crediti · 3,4 s · stessa risposta
Instradamento per categoria
attivo
1:5crediti · stesso esito
  • codingsimple · qwen-coder
  • extractsimple · gemini-flash
  • reasoningcomplex · modello premium
  • creativemoderate · claude
Ogni scelta finisce nel log della richiesta.
Salute dei provider · 24h
sani
Alta· nessun rallentamento
  • Fallback usati0,4%
  • Richieste servite99,2%
  • Riprova automaticaattiva
Dentro questa funzione
  • 01
    Classificatore a costo zero

    Un modello Gemini Flash legge la richiesta e decide il livello. Non ti costa crediti, mai.

  • 02
    Tre livelli, prezzo chiaro

    Simple 1 credito, Moderate 3, Complex 5. Il livello scelto e il perché sono scritti nella risposta.

  • 03
    Alias di categoria

    airouter-coding, -reasoning, -fast, -creative, -extract: dichiari l'uso, non il modello.

  • 04
    Fallback multi-hub

    Se un provider è giù o rifiuta, la richiesta passa al successivo. La risposta dichiara se è successo.

  • 05
    Override quando serve

    Puoi forzare il livello o il modello per singola richiesta: l'automatismo non ti chiude nessuna porta.

  • 06
    Tutto tracciato per chiave

    Modello effettivo, token, crediti, costo stimato e latenza: per ogni richiesta, per ogni chiave API.

La classificazione non consuma crediti · su ogni richiesta Vedi i livelli →
02
Funzione due
Il percorso di una richiesta
classificazione 120 ms· 0 crediti· fallback automatico· risposta arricchita

Non scegli il modello.
Lo sceglie il classificatore in 120 ms.

Dal momento in cui la richiesta entra a quando esce la risposta ci sono cinque passaggi, e nessuno te lo devi scrivere tu: classificazione, scelta del livello, scelta del modello, chiamata con fallback, risposta arricchita con modello, crediti, costo e latenza.

CL
Classificatore · scelta del livello
Gemini Flash · 0 crediti
pronto
richiesta «Riscrivi questa query SQL perché usi l'indice giusto e spiegami in due righe cosa cambia.»
deciso in 120 ms
✓ livello moderate · richiesta in ingresso · classificazione · livello moderate · modello disponibile? · chiamata upstream · risposta arricchita · …
Leggi la documentazione →
percorso_richiesta.v1 · stesso percorso per ogni chiamata
5 passaggi 2 uscite v1 · live
ingresso
POST /v1/chat/completions
SDK OpenAI
classificazione
Categoria e complessità
0 crediti · 120 ms
livello · modello
moderate → 3 crediti
modello più economico adeguato
provider sano · esci
Risposta arricchita
modello · costo · latenza
se il provider rifiuta
Fallback multi-hub
fallback_used: true
ingresso · classificazione · instradamento · risposta
3
Livelli

Simple, Moderate, Complex: 1, 3 e 5 crediti. Il classificatore sceglie, tu puoi forzare.

0
Crediti per decidere

La classificazione gira su un modello gratuito dell'hub: non tocca il tuo saldo.

120ms
Decisione

Il tempo che il classificatore aggiunge prima di instradare. Sotto il rumore di rete.

v
Version control

Every save is a version. Roll back, diff, share previews with a link.

03
Funzione tre
Log, costi e analytics
per chiave API· costo stimato· latenza reale· nessun prompt salvato

Sai sempre.
Anche quanto hai speso.

Ogni richiesta lascia una riga: modello effettivo, livello scelto e da chi, token in ingresso e in uscita, crediti, costo stimato in dollari, latenza e se è scattato un fallback. Il contenuto dei prompt no: quello non lo conserviamo.

Viste
Tutte 14
Questa chiave3
Con fallback5
Errori 2
In streaming8
Ultima ora 42
Livelli
simple moderate complex alias
Tutte · 1.284 ultime 24h
req_8f21c4simple
gemini-flash · 1 credito · 0,9 s
simplecomplex
req_8f21c3complex
modello premium · 5 crediti · 3,4 s
req_8f21c2moderate
claude · 3 crediti · 1,8 s · fallback
req_8f21c1simple
qwen-coder · 1 credito · 0,7 s
req_8f21c0alias
airouter-coding · 1 credito · 1,1 s
#1
req_8f21c4 · airouter-auto
chiave «produzione» · simple · 1 credito · 0,9 s
servita
richiesta in ingresso · 412 token · streaming attivo
14:08
↳ classificatore · gemini flash · 0 crediti
categoria: coding · complessità: simple
14:08 ✓✓
instradata a gemini-flash · 218 token in uscita · nessun fallback
14:09 ✓✓
nota interna · non lasciamo tracce del prompt
del contenuto non resta nulla: solo i metadati che vedi qui.
+
Esporta la riga · CSV o API
⌘↵
Richiesta
Livellosimple
Token412 / 218
Costo$0,0004
Providergemini
Fallbackno
Tempi
classificazione120 ms
totale0,9 s
Chiave
PRproduzione
01
Filtri per chiave

Isoli il traffico di un progetto guardando una chiave sola.

02
Costi stimati

Crediti e dollari per richiesta, per giorno, per modello.

03
Nessun prompt

Registriamo metadati, non il contenuto di richieste e risposte.

04
Origine del livello

Sai se ha deciso il classificatore, un alias, un preset o tu.

05
Fallback visibili

Ogni risposta dichiara se è passata da un provider di riserva.

06
Webhook sugli eventi

request.completed, credit.threshold, routing.fallback: firmati HMAC.

04
Funzione quattro
Preset del router
20 preset pronti· 9 categorie· per chiave API· o per server MCP

20 preset pronti.
Assegnati in un clic.

Il routing automatico ti basta? Perfetto. Vuoi il controllo? Un preset fissa quale modello serve Simple, Moderate e Complex, e lo assegni a una singola chiave API o al tuo server MCP. Il menù mostra solo i modelli che l'hub dichiara sani in quel momento.

DEV
sviluppo · codice
3 livelli · assegnabile
attivo
Simple → qwen-coder
Moderate → claude · Complex → modello di ragionamento.
categoria sviluppo
chiave «produzione» 1 · 3 · 5 crediti
CNT
contenuti · scrittura
3 livelli · assegnabile
attivo
Simple → gemini-flash
Moderate → claude · Complex → premium
chiave «redazione» 1 · 3 · 5 crediti
FREE
solo modelli gratuiti
costo zero · qualità variabile
attivo
only_free attivo:
0 crediti
L'editor ti avvisa: possono non essere disponibili.
categoria sviluppo
chiave «prove» 0 crediti

Come funziona.

Scegli un preset dalla galleria, cambia i modelli che vuoi, salvalo e assegnalo a una chiave. Da quel momento tutte le richieste di quella chiave usano i tuoi modelli, mantenendo livelli e prezzi in crediti.

Controlli prima del salvataggio
5 / 5 superati
  • Un modello per ognuno dei tre livelli
  • Modelli dichiarati sani dall'hub in questo momento
  • Nessun modello ritirato dal catalogo
  • Compatibilità con streaming e alias
  • Chiave o server MCP di destinazione valido
  1. A
    Parti da un preset o duplica il tuo

    20 preset predefiniti su 9 categorie: sviluppo, contenuti, dati, ricerca, traduzione, conversazione, professionale, settore, generale.

  2. B
    Scegli il modello per ogni livello

    Il menù propone solo i modelli che l'hub dichiara sani: i ritirati sono marcati, non nascosti.

  3. C
    Salva: controlliamo prima di scrivere

    Se un modello non è più servibile te lo diciamo al salvataggio, non al primo errore in produzione.

  4. D
    Assegna a una chiave o al server MCP

    Da lì in avanti quella chiave usa i tuoi modelli. Senza preset, usa il routing curato di default.

05
Funzione cinque
Superfici · 3 modi di chiamarci
OpenAI· Anthropic· MCP· stesso saldo

Tre modi di collegarti.
Un solo saldo alla fine.

Usa l'SDK OpenAI che hai già, l'SDK Anthropic se il tuo stack è quello, oppure il server MCP se a chiamare è un agente. Tre superfici, una sola chiave, un solo saldo crediti, lo stesso routing sotto.

Consigliata
WA
superficie · 01
OpenAI

Chat Completions, drop-in.

Cambi due righe: base_url su https://airouter.it/v1 e il modello su airouter-auto. Streaming SSE incluso, nessun refactor.

  • Tempo di setup~2 min
  • Rotta/v1/chat/completions
  • StreamingSSE nativo
  • Ideale perapp già in produzione
Tw
superficie · 02
Anthropic

Messages API, stessa chiave.

L'SDK Anthropic autentica con x-api-key: usi la tua chiave AI Router e chiami /v1/messages come sempre.

  • Tempo di setup~2 min
  • Rotta/v1/messages
  • Authx-api-key
  • Ideale perstack su SDK Anthropic
per agenti
QR
superficie · 03
MCP

Un tool per i tuoi agenti.

Model Context Protocol su HTTP streamable, stessa autenticazione Bearer delle chiamate API. Espone un tool, ask_airouter, con budget e max_tokens per chiamata.

  • Tempo di setup~1 min
  • Rotta/mcp
  • Preset dedicato
  • Ideale peragenti · strumenti
08
Per tipo di carico
Casi d'uso
4 carichi tipici· stesso endpoint· risparmio misurabile

Fatto per ogni
tipo di carico.

i Prodotti SaaS

Chat e assistenti
dentro il tuo prodotto

  • Risposte brevi al livello Simple
  • Escalation automatica quando serve
  • Streaming SSE già supportato
  • Costo per conversazione tracciato
effetto tipico meno spesa per chat
ii Agenzie e studi

Un endpoint per
tutti i clienti.

  • Una chiave API per cliente
  • Preset diverso per progetto
  • Costi separati e leggibili
  • Nessun contratto per provider
effetto tipico una fattura sola
iii Pipeline di dati

Estrazione e
classificazione in massa.

  • Alias airouter-extract e -fast
  • Livello Simple sul grosso del volume
  • Fallback se un provider cade
  • Log per riconciliare i costi
effetto tipico volume a 1 credito
iv Agenti e strumenti

Server MCPamp;
per i tuoi agenti.

  • Tool ask_airouter su HTTP
  • Stessa auth Bearer delle API
  • Preset dedicato al server MCP
  • Budget e max_tokens per chiamata
effetto tipico un tool, un saldo
07
Prezzi
Paghi a crediti, non a modello
500 crediti di benvenuto· nessuna carta richiesta· disdici quando vuoi

Semplice, onesto,
a crediti.

— Piano · 01
gratis

Free

Per provare il routing sul traffico vero.

€0 per sempre
Volume
  • 500 crediti di benvenuto
  • 1 chiave API
  • Livello Simple del router
  • Livelli Moderate e Complex
Funzioni
  • Routing automatico
  • Alias di categoria
  • Streaming SSE
  • Preset del router
  • Webhook firmati
  • Server MCP
  • Magazzino di memorie
Supporto
  • Documentazione e community
  • Supporto prioritario
Inizia gratis →
— Piano · 02

Starter

Per il primo progetto in produzione.

€19 /mese
Volume
  • 10.000 crediti / mese
  • Fino a 5 chiavi API
  • Tutti e tre i livelli
  • 1.000 voci di memoria
Funzioni
  • Routing automatico
  • Alias di categoria
  • Streaming SSE
  • Preset del router
  • Webhook firmati
  • Server MCP
  • Magazzino di memorie
Supporto
  • Documentazione e community
  • Supporto prioritario
Scegli Starter →
— Piano · 03
consigliato

Pro

Per team in crescita e agenti in produzione.

€49 /mese
Volume
  • 50.000 crediti / mese
  • Chiavi API multiple
  • Tutti e tre i livelli
  • 10.000 voci di memoria
Funzioni
  • Routing automatico
  • Alias di categoria
  • Streaming SSE
  • Preset del router
  • Webhook firmati
  • Server MCP
  • Magazzino di memorie
Supporto
  • Documentazione e community
  • Supporto prioritario
Scegli Pro →
— Piano · 04

Business

Per volumi alti e più team sulla stessa chiave.

€149 /mese
Volume
  • 200.000 crediti / mese
  • Chiavi API multiple
  • Tutti e tre i livelli
  • 50.000 voci di memoria
Funzioni
  • Routing automatico
  • Alias di categoria
  • Streaming SSE
  • Preset del router
  • Webhook firmati
  • Server MCP
  • Magazzino di memorie
Supporto
  • Documentazione e community
  • Supporto prioritario
Scegli Business →
Onestà sui prezzi
Paghi la richiesta
Non il modello. Mai a postazione.
Classificare costa 0
Il livello lo decide un modello che non paghi.
Annuale = 2 mesi gratis
Dodici mesi al prezzo di dieci.
Prezzi IVA inclusa
Quello che vedi è quello che paghi.
FAQ

Domande frequenti.

Non trovi la risposta? Scrivici a info@airouter.it — risponde una persona.

Devo cambiare SDK?

No. Resti sull'SDK OpenAI che usi già: cambi base_url e il nome del modello, e sei operativo. Sono supportate anche le superfici Anthropic /v1/messages e OpenAI Responses /v1/responses.

Come scegliete il modello?

Un classificatore economico (un modello Gemini Flash, che ti costa 0 crediti) valuta categoria e complessità della richiesta; il router instrada al modello più economico adeguato a quel livello — Simple, Moderate o Complex.

Cosa succede se un provider è giù?

Fallback automatico cross-hub tra i nostri provider di inferenza: la richiesta passa al successivo senza perdersi. Ogni risposta dichiara se il fallback è stato usato (fallback_used: true).

Che fine fanno i miei dati?

Il contenuto di richieste e risposte non viene conservato nei nostri log: registriamo solo metadati — modello, complessità, token, costo, latenza. I prompt sono trasmessi ai provider AI per generare la risposta. Il dettaglio è nella Privacy Policy.

Posso forzare un modello o un livello?

Sì. Usi gli alias di categoria (airouter-coding, airouter-reasoning, …) oppure forzi direttamente il livello. Sul piano gratuito il livello resta Simple.

Come si paga?

A crediti, via Stripe: abbonamento mensile o annuale con crediti ricorrenti, oppure pacchetti di crediti una-tantum. Prezzi IVA inclusa. Simple costa 1 credito, Moderate 3, Complex 5, la classificazione 0.

— Inizia adesso

Smetti di pagare
troppo per l'AI.

Un endpoint, tutti i modelli, la spesa sotto controllo. Operativo in due minuti.

Cosa ricevi subito
sk-
Chiave API personale
sk-airouter-… · attiva subito
500
Crediti di benvenuto
alla verifica dell'email
3
Superfici compatibili
OpenAI · Anthropic · MCP