// TOM'S HARDWARE ITALIA — INTELLIGENZA ARTIFICIALE
Il traffico tra i modelli AI ormai vale miliardi, tanto quanto i modelli stessi
Stripe ha comprato OpenRouter per una cifra riportata tra 7,5 e oltre 8 miliardi di dollari. Il servizio smista le richieste di oltre 10 milioni di sviluppatori tra più di 400 modelli AI offerti da 80 fornitori, sceglie di volta in volta quello più adatto per costo, velocità, qualità e residenza dei dati, e trattiene circa il 5% della spesa in inferenza che instrada, oltre 10mila miliardi di token al giorno. I dettagli dell'operazione sono stati ricostruiti nei giorni successivi da più testate indipendenti.
La tendenza si chiama model routing dinamico: instradare ogni richiesta verso il modello più adatto invece di appoggiarsi a un solo fornitore, per tenere sotto controllo i costi e la dipendenza da un singolo vendor. È lo stesso principio alla base delle reti aziendali che smistano il traffico in base a condizioni reali invece che su percorsi fissi: chi controlla lo smistamento incassa comunque, indipendentemente da quale modello vince la singola richiesta.
L'operazione arriva con OpenRouter già abituata a muoversi da sola. Il co-fondatore Alex Atallah ha scritto che il servizio resta una piattaforma aperta a tutti i fornitori di modelli, con Stripe nel ruolo di proprietario tra tanti partner. Il vantaggio che vende è l'indipendenza dal singolo vendor, lo stesso problema che spinge Satya Nadella a mettere in guardia dal puntare tutto su un solo modello AI.
NVIDIA ha già dato un nome e dei numeri a questo meccanismo con NeMo Switchyard, un router a scalino che smista i compiti degli agenti tra modelli diversi in base alla difficoltà del singolo passaggio. Nei test pubblicati da NVIDIA, quel router taglia i costi del 74% nel confronto LangChain, e un routing a più stadi arriva al 28% su Cognition Devin Desktop. Lo stesso principio era già arrivato su queste pagine qualche settimana fa, quando NVIDIA lo aveva proposto come risposta diretta ai costi dell'inferenza aziendale.
Il meccanismo dietro il risparmio è un classificatore che valuta la difficoltà del compito prima di instradarlo, riservando i modelli più costosi solo ai passaggi che li richiedono davvero. Le strategie tecniche descritte da AWS per architetture simili includono anche il fallback: se il modello economico sbaglia, la richiesta risale a uno più capace senza intervento umano.
Accanto al costo, il livello di instradamento pesa anche altri criteri. OpenRouter spiega che può far rispettare la residenza dei dati, inviando una richiesta europea solo verso modelli ospitati in Europa. Per un'azienda regolata quella regola pesa quanto il prezzo per token, e a volte di più.
Il tema si allarga a un problema già toccato su queste pagine: i dati restano dell'azienda sulla carta, ma chi li elabora davvero, e dove, dipende da una scelta tecnica che raramente finisce sul tavolo di chi firma il contratto. Il livello di routing decide anche questo, oltre alla guerra dei prezzi che ancora non abbassa la spesa reale delle aziende.
Gli analisti di mercato leggono lo stesso spostamento su scala più larga. Il model routing viene descritto come la prossima fase dell'infrastruttura AI, il livello che sostituisce la scelta manuale di un singolo modello per ogni applicazione. Se la previsione regge, il valore si sposta più in alto nella catena, dal modello al software che decide quale modello usare.
Martin Casado, general partner di a16z, descrive il routing come un "abilitatore" economico, il livello che rende conveniente usare più modelli invece di scommettere su uno solo. Il paragone che sceglie è con i pagamenti: un instradamento efficiente vale, per l'AI, quanto un processore di pagamenti vale per l'e-commerce.
La stessa lettura spiega perché Stripe, che già instrada i pagamenti verso il metodo più conveniente per ogni transazione, abbia riconosciuto in OpenRouter lo stesso mestiere applicato ai modelli AI. È l'ennesima variante del vendor lock-in letta al contrario: invece di legarsi a un fornitore, l'azienda si lega al livello che sceglie il fornitore per lei.