B.AI 累计处理代币数突破 5.74 万亿,创 AI 使用量里程碑
要点速览
- •据 Justin Sun 于 2026 年 8 月 30 日宣布,B.AI 累计处理代币数已突破 5.74 万亿。
- •该平台免费提供六款前沿 AI 模型的访问,包括 GLM-5.3-Flash、Qwen3.8-Flash 和 DeepSeek-V4-Flash。
- •累计代币数反映的是计算活动量,而非财务估值或用户数量。
- •B.AI 自行为其推理容量提供资金,将算力成本从用户转移开,这可能降低开发者构建代理式应用的门槛。
- •随着平台使用量增长,无限免费提供算力的可持续性仍是关键考量。

据 Justin Sun 于 2026 年 8 月 30 日发布的消息,B.AI 平台累计处理的代币数已突破 5.74 万亿。这一里程碑凸显了该项目的 AI 推理服务需求规模,其持续向用户提供多款先进模型的访问,且不收取算力费用。
该数据表明 B.AI 基础设施上存在大量活动,尤其是来自运行高要求 AI 代理工作负载的用户。该平台目前提供六款前沿模型的访问,包括 GLM-5.3-Flash、Qwen3.8-Flash 和 DeepSeek-V4-Flash,用户无需承担直接算力成本即可运行这些模型。
值得注意的是该指标衡量与不衡量的内容:累计代币数反映的是通过平台处理的文本和计算活动总量,既不是财务估值,也不是个人用户数量。即便如此,突破 5.74 万亿代币仍表明了 B.AI 所支持的 AI 推理规模以及投入该服务的计算资源。
免费访问瞄准高强度 AI 工作负载
B.AI 的服务之所以突出,在于其将多模型访问与无限算力方案相结合。这种结构对 AI 代理尤为重要,因为 AI 代理可能执行反复推理、工具调用及其他自动化任务,其推理需求远高于传统的聊天机器人交互。在整个 AI 行业,代理式工作负载已成为推理需求的主要驱动力,因为自动化系统在每项任务中通常会发起多次模型调用,而非聊天机器人使用中典型的单次交互。
B.AI 在向用户提供六款前沿 AI 模型免费访问的同时,已处理超过 5.74 万亿累计代币,凸显了该平台正在部署的推理容量规模。
该服务提供的模型面向不同的 AI 工作负载设计,用户可以在相互竞争的模型架构之间进行选择,而不必依赖单一系统。GLM-5.3-Flash、Qwen3.8-Flash 和 DeepSeek-V4-Flash 是已确认可在该平台上使用的模型之一。
这种零成本模式还消除了试验大语言模型的关键制约之一。开发者和用户在大规模运行 AI 系统时通常面临使用限制或按代币计费,这也是大多数商业模型提供商计量访问的方式。通过自行承担算力成本,B.AI 将其基础设施定位为持续实验和密集代理部署的平台。
工业级推理基础设施
5.74 万亿代币的里程碑也反映了运行现代前沿 AI 模型所需基础设施的更广泛扩张。处理如此规模的数据需要大量计算能力,尤其是在工作负载涉及自主或半自主代理产生的重复模型调用时。
据报道,B.AI 正在为其免费访问模式所需的推理容量提供资金支持。这种方式实际上将计算成本从个人用户转移到了项目自身的基础设施和资金资源上。
累计总吞吐量已经突破5.7万亿! — H.E. Justin Sun (@justinsuntron) August 30, 2026
该平台在不收取直接算力费用的情况下维持重型代理工作负载的能力,可能会降低开发者测试自主 AI 应用及其他高吞吐量推理用例的门槛。
这一进展正值 AI 平台在模型质量和经济适用的计算资源获取两方面竞争日益加剧之际。虽然模型性能仍是重要考量因素,但推理的成本和可用性可能决定开发者能否将有意义的规模部署应用。
因此,B.AI 的最新使用数据既是采用率的指标,也是基础设施利用率的衡量标准。多款模型的持续可用,或将进一步鼓励用户比较不同系统并构建应用,而无需投入大量前期计算开支。
该平台目前可通过其 B.AI 界面访问,用户可以在其中直接部署可用模型。随着使用量的增长,无限免费提供算力的可持续性仍将是该项目需要重点考量的问题。
目前,5.74 万亿代币的里程碑标志着可观的累计 AI 处理量,也凸显了随着 AI 行业从传统聊天机器人用途向日益密集的代理式应用扩展,大规模推理容量正受到越来越多的重视。
本文《B.AI Surpasses 5.74 Trillion Tokens in AI Usage Milestone》首发于 CoinTrust。