NachrichtenAktienAolani startet Token Factory für verwaltete KI-Inferenz in Asien

Aolani startet Token Factory für verwaltete KI-Inferenz in Asien

Autor: Citybuzz·

Wichtige Erkenntnisse

  • Aolani Token Factory nutzt ein Abrechnungsmodell pro Token, bei dem Kunden Guthaben im Voraus kaufen und nach Token-Nutzung bezahlen.
  • Aolani verwaltet den gesamten Inferenz-Stack, einschließlich GPU-Zuweisung, Model Serving, Orchestrierung, Scheduling und Workload-Optimierung.
  • Die Plattform startet mit Unterstützung für Open-Source-Modelle wie DeepSeek, GLM, Kimi und Qwen und kann auch eigene Modelle über OpenAI-kompatible APIs hosten.
  • Für Unternehmen mit Anforderungen an Compliance und Datensouveränität stehen dedizierte Kapazitäten und Datenisolierung zur Verfügung.
  • Aolani zufolge richtet sich die Plattform an KI-Agenten, Enterprise-Copiloten und Wissensassistenten sowie an Coding-Agenten für Entwicklungsaufgaben.
Aolani startet Token Factory für verwaltete KI-Inferenz in Asien

Das in Singapur ansässige Neocloud-Unternehmen Aolani hat die Aolani Token Factory vorgestellt, eine verwaltete Inferenzplattform, die es Organisationen ermöglicht, KI-Modelle auf Pay-per-Token-Basis bereitzustellen und zu skalieren, ohne die zugrunde liegende GPU-Infrastruktur bereitstellen oder verwalten zu müssen. Mit der Ankündigung positioniert sich Aolani als erstes in Singapur gegründetes Neocloud-Unternehmen, das produktionsreife, verwaltete Inferenz in großem Maßstab anbietet.

Da globale KI-Unternehmen ihre Aktivitäten in Singapur ausbauen und Unternehmen weltweit in KI investieren, um messbare Geschäftsergebnisse zu erzielen, steigt die Nachfrage nach produktionsreifer Inferenzinfrastruktur. Dieser Wandel ist bedeutsam, weil das Training von Modellen zwar früh viel Aufmerksamkeit auf sich gezogen hat, der zuverlässige Betrieb von Modellen in der Produktion jedoch fortlaufende Anforderungen an Rechenleistung, Compliance und Betrieb mit sich bringt. Die Aolani Token Factory soll diese Zugangslücke schließen und KI-nativen Unternehmen sowie Konzernen einen konformen, leistungsstarken Weg von Experimenten zur produktiven Bereitstellung bieten.

Die Plattform arbeitet mit einem Token-basierten Abrechnungsmodell, bei dem Kunden Guthaben im Voraus kaufen und entsprechend dem Token-Verbrauch bezahlen, wodurch kapitalintensive GPU-Investitionen vermieden werden. Aolani übernimmt den gesamten Inferenz-Stack, einschließlich Zuweisung von GPU-Kapazitäten, Model Serving, Orchestrierung, Scheduling und Workload-Optimierung, sodass Kunden ihren Verbrauch ohne fortlaufende Infrastrukturbereitstellung skalieren können.

Zum Start unterstützt die Token Factory führende Open-Source-Modelle wie DeepSeek, GLM, Kimi und Qwen; eine Erweiterung des Angebots ist entsprechend der Kundennachfrage geplant. Kunden können außerdem eigene Modelle über OpenAI-kompatible APIs bereitstellen. Für Unternehmen mit strengen Anforderungen an Compliance und Datensouveränität stehen dedizierte Kapazitäten und Optionen zur Datenisolierung zur Verfügung.

Die Plattform zielt auf drei zentrale Produktionsanwendungsfälle ab: KI-Agenten für Inferenz mit hohem Volumen und Workflow-Automatisierung, Enterprise-KI-Anwendungen wie interne Copiloten und Wissensassistenten sowie Coding-Agenten für Code-Generierung, Vervollständigung, Tests und Reviews.

Sea Xu, Applied AI Research Lead bei Aolani, hob die Leistung und Flexibilität der Plattform hervor: „Die Aolani Token Factory basiert auf einem leistungsstarken Inferenz-Stack, der die gefragtesten Open-Source-Modellfamilien unterstützt. Wir haben die Plattform für schnelle Modellanpassung und Bereitstellung entwickelt, damit unsere Kunden bei neuen Modellen rasch Zugriff erhalten können. Da sich das KI-Ökosystem in Südostasien schnell weiterentwickelt und wächst, ist es unser Ziel sicherzustellen, dass die dafür dienende Infrastruktur Schritt hält.“

Nicholas Chia, CEO von Aolani, betonte die transformative Wirkung: „Schnell agierende KI-native Unternehmen möchten Produkte flexibel und on-demand entwickeln und ausliefern, ohne GPU-Flotten verwalten zu müssen. Mit unserer wettbewerbsfähigen Preisgestaltung pro Token und einem vollständig verwalteten Stack können Unternehmen von der Modellauswahl zur produktiven Bereitstellung wechseln, ohne die Kapitalausgaben oder die betriebliche Komplexität einer selbst verwalteten Infrastruktur. Dies ist ein bedeutender Meilenstein für uns und unsere Kunden, da die Aolani Token Factory grundlegend verändern wird, wie Kunden auf KI-Rechenleistung zugreifen.“

Die Einführung erfolgt vor dem Hintergrund einer wachsenden regionalen Nachfrage nach KI-Infrastruktur, auch in Singapur, wo Unternehmen mehr KI-Dienste entwickeln und bereitstellen, die zuverlässige Inferenz statt einmaliger Experimente erfordern. Mit einem verwalteten Pay-as-you-go-Modell will Aolani die Hürden für Unternehmen jeder Größe senken und ihnen ermöglichen, fortschrittliche KI-Funktionen ohne Vorabinvestitionen zu nutzen. Dieses Modell könnte besonders für Startups und mittelständische Unternehmen relevant sein, die Zugriff auf produktive Infrastruktur benötigen, aber ihre eigene GPU-Stack nicht aufbauen und betreiben möchten.

Interessierte können ihr Interesse unter Aolani Token Factory registrieren. Weitere Informationen zu Aolani finden Sie auf Aolanis Website.