NotizieAzioniAolani lancia Token Factory per l’inferenza AI gestita in Asia

Aolani lancia Token Factory per l’inferenza AI gestita in Asia

Autore: Citybuzz·

Punti chiave

  • Aolani Token Factory utilizza un modello di fatturazione per token, con i clienti che acquistano crediti in anticipo e pagano in base all’uso dei token.
  • Aolani gestisce l’intero stack di inferenza, inclusi allocazione GPU, model serving, orchestration, scheduling e ottimizzazione dei carichi di lavoro.
  • La piattaforma debutta con il supporto per modelli open-source tra cui DeepSeek, GLM, Kimi e Qwen, e può ospitare anche modelli personalizzati tramite API compatibili con OpenAI.
  • Sono disponibili opzioni di capacità dedicata e isolamento dei dati per le imprese con requisiti di conformità e data residency.
  • Aolani afferma che la piattaforma è destinata ad AI agent, copiloti aziendali e assistenti alla conoscenza, oltre che a coding agent per attività di sviluppo.
Aolani lancia Token Factory per l’inferenza AI gestita in Asia

La neocloud con sede a Singapore Aolani ha presentato Aolani Token Factory, una piattaforma di inferenza gestita progettata per consentire alle organizzazioni di distribuire e scalare modelli AI con un modello pay-per-token, eliminando la necessità di predisporre o gestire l’infrastruttura GPU sottostante. L’annuncio posiziona Aolani come la prima neocloud fondata a Singapore a offrire inferenza gestita di livello produttivo su scala.

Mentre le società AI globali ampliano le attività a Singapore e le imprese di tutto il mondo investono nell’AI per ottenere risultati di business concreti, la domanda di infrastrutture di inferenza di livello produttivo sta accelerando. Questo cambiamento è rilevante perché l’addestramento dei modelli ha attirato gran parte dell’attenzione iniziale sull’AI, ma l’esecuzione affidabile dei modelli in produzione è il punto in cui le organizzazioni affrontano esigenze ricorrenti di calcolo, conformità e operatività. Aolani Token Factory mira a colmare il divario di accessibilità, offrendo a società native AI e imprese un percorso conforme e ad alte prestazioni dalla sperimentazione al deployment in produzione.

La piattaforma opera con un modello di misurazione per token, in cui i clienti acquistano in anticipo crediti e pagano in base al consumo di token, evitando investimenti in GPU ad alta intensità di capitale. Aolani gestisce l’intero stack di inferenza, inclusi l’allocazione della capacità GPU, il model serving, l’orchestration, la scheduling e l’ottimizzazione dei carichi di lavoro, consentendo ai clienti di scalare i consumi senza una continua predisposizione dell’infrastruttura.

Al lancio, Token Factory supporta modelli open-source leader come DeepSeek, GLM, Kimi e Qwen, con piani di ampliare il catalogo in base alla domanda dei clienti. I clienti possono anche distribuire modelli personalizzati tramite API compatibili con OpenAI. Per le imprese con severi requisiti di conformità e di data residency, sono disponibili opzioni di capacità dedicata e isolamento dei dati.

La piattaforma è orientata a tre principali casi d’uso in produzione: AI agent per inferenza ad alto volume e automazione dei flussi di lavoro, applicazioni AI aziendali come copiloti interni e assistenti alla conoscenza, e coding agent per generazione, completamento, testing e revisione del codice.

Sea Xu, Applied AI Research Lead di Aolani, ha evidenziato le prestazioni e la flessibilità della piattaforma: “Aolani Token Factory è costruita su uno stack di inferenza ad alte prestazioni che supporta le famiglie di modelli open-source più richieste. Abbiamo progettato la piattaforma per un’adozione e un deployment rapidi dei modelli, così i nostri clienti possono accedervi velocemente man mano che emergono nuovi modelli. Man mano che l’ecosistema AI del Sud-est asiatico si evolve e cresce rapidamente, il nostro obiettivo è garantire che l’infrastruttura che lo supporta tenga il passo.”

Nicholas Chia, CEO di Aolani, ha sottolineato l’impatto trasformativo: “Le realtà AI in rapida evoluzione vogliono costruire e rilasciare prodotti in modo flessibile e on-demand, senza dover gestire flotte di GPU. Con il nostro pricing competitivo per token e uno stack completamente gestito, le aziende possono passare dalla selezione del modello al deployment in produzione senza l’esborso di capitale o la complessità operativa di un’infrastruttura autogestita. Si tratta di una tappa significativa per noi e per i nostri clienti, poiché Aolani Token Factory cambierà in modo fondamentale il modo in cui i clienti accedono al calcolo AI.”

Il lancio arriva in un contesto di crescente domanda regionale di infrastrutture AI, anche a Singapore, dove le aziende stanno costruendo e distribuendo più servizi AI che richiedono un’inferenza affidabile piuttosto che una sperimentazione una tantum. Offrendo un modello gestito pay-as-you-go, Aolani punta ad abbassare le barriere per imprese di tutte le dimensioni, consentendo loro di sfruttare capacità AI avanzate senza investimenti iniziali. Questa impostazione potrebbe essere particolarmente rilevante per startup e imprese di medie dimensioni che necessitano di accesso a infrastrutture di produzione ma preferiscono non costruire e mantenere il proprio stack GPU.

Le parti interessate possono registrare il proprio interesse su Aolani Token Factory. Per ulteriori informazioni su Aolani, visitare il sito web di Aolani.