Aolani lance Token Factory pour l’inférence IA gérée en Asie
Points clés
- •Aolani Token Factory utilise un modèle de facturation au token, avec des crédits préachetés et un paiement selon l’usage des tokens.
- •Aolani gère l’ensemble de la pile d’inférence, y compris l’allocation GPU, le service des modèles, l’orchestration, la planification et l’optimisation des charges de travail.
- •La plateforme est lancée avec la prise en charge de modèles open source dont DeepSeek, GLM, Kimi et Qwen, et peut aussi héberger des modèles personnalisés via des API compatibles OpenAI.
- •Des options de capacité dédiée et d’isolation des données sont proposées pour les entreprises ayant des exigences de conformité et de résidence des données.
- •Aolani indique que la plateforme vise les agents d’IA, les copilotes et assistants de connaissance pour les entreprises, ainsi que les agents de codage pour les tâches de développement.

La néocloud singapourienne Aolani a dévoilé Aolani Token Factory, une plateforme d’inférence gérée conçue pour permettre aux organisations de déployer et de faire évoluer des modèles d’IA selon un modèle de paiement au token, sans avoir à provisionner ni à gérer l’infrastructure GPU sous-jacente. Cette annonce positionne Aolani comme la première néocloud fondée à Singapour à proposer une inférence gérée de niveau production à grande échelle.
Alors que les entreprises mondiales de l’IA étendent leurs activités à Singapour et que des entreprises du monde entier investissent dans l’IA pour obtenir des résultats commerciaux concrets, la demande d’une infrastructure d’inférence de niveau production s’accélère. Ce mouvement est important, car l’entraînement des modèles a retenu l’essentiel de l’attention au début de l’IA, mais l’exploitation fiable des modèles en production est le point où les organisations font face à des besoins récurrents en calcul, en conformité et en opérations. Aolani Token Factory vise à réduire l’écart d’accessibilité en offrant aux entreprises nées avec l’IA et aux grandes organisations une voie conforme et performante, de l’expérimentation au déploiement en production.
La plateforme fonctionne sur un modèle de facturation au token, dans lequel les clients achètent des crédits à l’avance et paient en fonction de la consommation de tokens, évitant ainsi des investissements intensifs en capital dans des GPU. Aolani gère l’ensemble de la pile d’inférence, y compris l’allocation de capacité GPU, le service des modèles, l’orchestration, la planification et l’optimisation des charges de travail, ce qui permet aux clients d’augmenter leur consommation sans provisionnement continu d’infrastructure.
Au lancement, Token Factory prend en charge des modèles open source de premier plan tels que DeepSeek, GLM, Kimi et Qwen, avec l’intention d’élargir le catalogue en fonction de la demande des clients. Les clients peuvent également déployer des modèles personnalisés via des API compatibles OpenAI. Pour les entreprises ayant des exigences strictes en matière de conformité et de résidence des données, des options de capacité dédiée et d’isolation des données sont disponibles.
La plateforme cible trois principaux cas d’usage en production : les agents d’IA pour l’inférence à volume élevé et l’automatisation des flux de travail, les applications d’IA d’entreprise telles que les copilotes internes et les assistants de connaissance, ainsi que les agents de codage pour la génération de code, l’achèvement, les tests et la revue.
Sea Xu, Applied AI Research Lead chez Aolani, a mis en avant les performances et la flexibilité de la plateforme : « Aolani Token Factory repose sur une pile d’inférence haute performance qui prend en charge les familles de modèles open source les plus demandées. Nous avons conçu la plateforme pour une adaptation et un déploiement rapides des modèles, afin que nos clients puissent y accéder rapidement à mesure que de nouveaux modèles émergent. À mesure que l’écosystème de l’IA en Asie du Sud-Est évolue et croît rapidement, notre objectif est de veiller à ce que l’infrastructure qui le soutient suive le rythme. »
Nicholas Chia, CEO d’Aolani, a souligné l’impact transformationnel : « Les acteurs de l’IA qui avancent rapidement veulent créer et livrer des produits de manière flexible et à la demande, sans avoir à gérer des flottes de GPU. Avec notre tarification compétitive au token et une pile entièrement gérée, les entreprises peuvent passer de la sélection du modèle au déploiement en production sans l’investissement en capital ni la complexité opérationnelle d’une infrastructure autogérée. C’est une étape importante pour nous et pour nos clients, car Aolani Token Factory va changer en profondeur la manière dont les clients accèdent au calcul IA. »
Ce lancement intervient dans un contexte de demande régionale croissante pour l’infrastructure IA. En proposant un modèle géré, facturé à l’usage, Aolani cherche à réduire les obstacles pour les entreprises de toutes tailles, leur permettant d’exploiter des capacités avancées d’IA sans investissement initial. Cette approche pourrait accélérer l’adoption de l’IA en Asie, en particulier parmi les startups et les entreprises de taille intermédiaire qui faisaient auparavant face à des coûts prohibitifs.
Les parties intéressées peuvent manifester leur intérêt sur Aolani Token Factory. Pour plus d’informations sur Aolani, consultez le site d’Aolani.
L’article Aolani Launches Token Factory to Democratize AI Inference in Asia est apparu en premier sur citybuzz .