B.AI supera 220 miliardi di token in 48 ore, conquistando il 20% del traffico OpenRouter
Punti chiave
- •B.AI ha elaborato oltre 220 miliardi di token in 48 ore, segnalando un uso molto intenso dell'inferenza AI.
- •La piattaforma avrebbe rappresentato circa il 20% del traffico di OpenRouter nello stesso periodo.
- •B.AI ha reso disponibile DeepSeek-V4-Flash senza una soglia minima di utilizzo.
- •Justin Sun ha evidenziato il traguardo collegandolo alla crescente adozione della piattaforma per carichi di lavoro AI su larga scala.
- •La crescita riportata suggerisce una maggiore concorrenza nei servizi di inferenza AI, mentre gli sviluppatori cercano accesso a costi più bassi e con maggiore capacità.

B.AI ha elaborato oltre 220 miliardi di token in 48 ore, un traguardo che evidenzia la rapida crescita della domanda per la sua infrastruttura di intelligenza artificiale e la presenza in espansione nell'ecosistema OpenRouter. I token — le parole e i frammenti di parole che i modelli linguistici leggono e generano — sono l'unità con cui la maggior parte dell'inferenza AI viene misurata e fatturata, rendendo il dato una misura diretta della capacità di calcolo del modello gestita dalla piattaforma. Nello stesso periodo, la piattaforma avrebbe rappresentato circa il 20% del traffico di OpenRouter — circa un quinto — mettendo inoltre DeepSeek-V4-Flash a disposizione senza una soglia minima di utilizzo.
I dati sono stati evidenziati da Justin Sun, fondatore della blockchain Tron e uno degli imprenditori più visibili dell'industria delle criptovalute, che ha richiamato l'attenzione sulla crescita dell'utilizzo della piattaforma e sulla sua capacità di supportare carichi di lavoro AI su larga scala. Il dato arriva mentre la domanda di inferenza AI a costo inferiore continua ad aumentare tra gli sviluppatori che eseguono applicazioni ad alta intensità di calcolo. La crescita riportata riflette anche una più ampia ricerca da parte degli sviluppatori di alternative in grado di gestire volumi significativi di token senza imporre gli stessi vincoli di costo o di utilizzo associati all'accesso API convenzionale.
Sun ha condiviso il traguardo su X:
突破2200亿,我理解已经达到openrouter 20%的流量了 — H.E. Justin Sun (@justinsuntron) August 19, 2026
L'accesso gratuito a DeepSeek-V4-Flash punta agli sviluppatori
Un elemento centrale della strategia di B.AI è la fornitura di accesso a DeepSeek-V4-Flash senza una soglia minima di utilizzo. L'offerta è rivolta a sviluppatori e organizzazioni che richiedono grandi quantità di capacità di inferenza per applicazioni impegnative. DeepSeek-V4-Flash è particolarmente adatto a carichi di lavoro che coinvolgono sviluppo software, agenti AI autonomi e sistemi che devono elaborare numerose richieste contemporaneamente. Eliminando una soglia d'ingresso per l'accesso, B.AI sta posizionando la piattaforma come un'opzione per gli sviluppatori che testano o distribuiscono applicazioni in grado di generare un consumo significativo di token.
La strategia si inserisce anche in un contesto di modifiche ai prezzi dei servizi API ufficiali di DeepSeek. DeepSeek, un laboratorio cinese di AI che ha costruito la propria reputazione su modelli rilasciati in modo aperto e prezzati ben al di sotto delle API consolidate, è stato un riferimento ricorrente nel dibattito sui prezzi dell'inferenza. La disponibilità di un canale di accesso alternativo potrebbe aumentare la კონკorrenza tra i fornitori di infrastrutture AI, mentre gli sviluppatori confrontano prezzi, capacità e prestazioni tra le varie piattaforme.
I carichi di lavoro elevati spingono il consumo di token
Il volume di token riportato indica la scala della domanda generata dalle applicazioni AI moderne. Gli strumenti di coding possono richiedere interazioni ripetute con il modello per analizzare file sorgente, generare codice, individuare errori e perfezionare le soluzioni. I sistemi basati su agenti possono generare carichi di lavoro ancora maggiori, poiché più processi AI possono operare simultaneamente coordinando i compiti.
La pianificazione multi-agent è un'altra area in cui un'elevata capacità di throughput dei token può diventare importante. Tali sistemi possono suddividere incarichi complessi tra diversi agenti specializzati, con ciascun agente che genera richieste e risposte che contribuiscono al consumo complessivo. I flussi API ad alta concorrenza richiedono inoltre infrastrutture in grado di gestire un gran numero di richieste simultanee.
L'attività riportata di B.AI suggerisce che la piattaforma stia attirando l'uso di sviluppatori le cui applicazioni necessitano di una capacità di inferenza continua anziché di interrogazioni occasionali del modello. La sua offerta gratuita di DeepSeek-V4-Flash è orientata a casi d'uso ad alta domanda come coding, sistemi multi-agent e applicazioni API ad alta concorrenza, in cui il consumo di token può aumentare rapidamente.
Il traffico di OpenRouter segnala un cambiamento competitivo
La quota riportata del 20% del traffico di OpenRouter fornisce un'ulteriore indicazione del ruolo crescente di B.AI nel mercato dell'accesso ai modelli AI. OpenRouter aggrega l'accesso a più modelli AI e consente agli sviluppatori di instradare i carichi di lavoro attraverso fornitori diversi, rendendo la quota di traffico un indicatore importante di dove gli utenti stanno indirizzando la domanda di inferenza. Poiché OpenRouter pubblica dati di utilizzo che gli sviluppatori monitorano da vicino, gli spostamenti in tale quota diventano rapidamente visibili nella comunità degli sviluppatori.
Una quota consistente di quel traffico può offrire a un fornitore di infrastrutture una maggiore visibilità tra gli sviluppatori che valutano modelli e API AI. Può inoltre creare opportunità per attirare utenti le cui applicazioni richiedono un accesso costante ai modelli a costi competitivi.
Il rapido aumento del volume di token di B.AI riflette un cambiamento più ampio nell'industria AI verso infrastrutture basate sul consumo. Con l'espansione delle capacità dei modelli, gli sviluppatori stanno andando oltre le semplici applicazioni conversazionali verso coding automatizzato, workflow agentici e sistemi in grado di gestire grandi volumi di richieste.
Le prestazioni riportate di B.AI indicano quindi una concorrenza crescente nell'accesso all'inferenza AI, soprattutto mentre gli utenti cercano combinazioni di convenienza, throughput e disponibilità. Se i livelli di utilizzo riportati dovessero persistere, la piattaforma potrebbe rafforzare la propria posizione come fornitore di infrastrutture significativo per gli sviluppatori che cercano accesso ai modelli AI su larga scala e in modo efficiente nei costi.
I dati più recenti mostrano anche quanto rapidamente la domanda possa cambiare nel mercato delle infrastrutture AI quando i fornitori introducono un accesso a basso costo o senza restrizioni a modelli popolari. La continuità dell'utilizzo determinerà se l'impennata rappresenti una risposta di breve periodo alle differenze di prezzo o un cambiamento più duraturo nei modelli di traffico degli sviluppatori.