| 主队 | 比分 | 客队 | 联赛 | 时间(北京) |
|---|---|---|---|---|
| 近期暂无比赛,请稍后再来查看。 | ||||
Token经济的崛起,正将AI产业的重心从训练转向推理。国家数据局在2026年3月披露,中国日均Token调用量已飙升至140万亿以上,较2024年初增长超千倍,显示出Token已成为AI时代最基本的交易单位,且其增长速度远超以往任何基础资源。IDC预测,到2030年,全球年度Token消耗量将达到15万Peta Token,年复合增长率高达3418%,同期全球活跃智能体数量预计将达3.5亿。
这一爆发式增长得益于AI领域的结构性转变。在2026年之前,AI产业主要聚焦于模型训练,而此后,推理正成为算力消耗的主要驱动力。IDC估计,2026年中国AI服务器市场规模将达到3500亿元,其需求结构已从“训练驱动”转变为“训练与推理并重”,推理服务器的出货量已接近训练机型。此外,智能体应用的兴起以及推理成本的显著下降,也在加速行业发展。智能体在执行自主规划、工具调用和多步骤任务时,会以指数级速度消耗Token。
这种转变对算力基础设施提出了颠覆性要求。PPIO联合创始人兼CEO姚欣指出,传统云计算主要服务于人类用户,其资源使用模式具有周期性。而AI智能体的任务调用则呈现碎片化、高频化的特点,PPIO平台上的Sandbox最小结算单位已精确到秒。与人类用户对延迟的容忍度不同,智能体在执行复杂任务时,即使是几百毫秒的延迟,累积效应也会严重影响任务效率。因此,为人类设计的云计算架构已难以满足Agent的需求。
在此背景下,Token工厂作为调节算力运力的关键环节,受到市场高度关注。灼识咨询数据显示,按2025年和2026年第一季度的平均日均Token消耗量计算,PPIO在中国独立AI云计算服务提供商中位居首位。2026年4月,其平台日均Token消耗量已达1.03万亿次,并在6月突破1.2万亿次,较2025年同期增长超过8倍。PPIO的AI云计算收入也从2024年的1038.7万元激增至2025年的1.192亿元,同比增长超过10倍。平台全球注册开发者数量也从2024年末的12.5万人增长到2026年6月的超过66.6万人。
随着推理成本的年下降,单纯提供算力已难以维持高溢价。PPIO提出的“智能Token工厂”旨在优化Token的全生命周期生产与交付。姚欣表示,尽管“Token工厂”概念在2026年3月的GTC大会上受到关注,但PPIO自2023年起便已投入推理服务,并在2024年推出了MaaS平台,在该领域积累了三年多的经验。他强调,提升Token工厂的智能化水平至关重要,关键在于如何高质量、高效率地生产更智能的Token。
姚欣提出了Agent时代的核心公式:Agent生产力 = Token智能密度 × Agent Loop时长。其中,Token智能密度决定了Agent决策的质量,Agent Loop时长则关乎Agent的持续运行能力和任务复杂度。为实现这一目标,PPIO在国内率先推出了智能模型网关,作为AI Agent的智能调度中心。该网关通过混合模型提升关键决策质量,并将简单任务分流至轻量模型,确保Agent以最低Token成本和最高智能性能完成任务,从而提升Token智能密度。
在混合模型方面,姚欣透露PPIO正在测试将两到三款模型组合使用,通过相互“PK”和讨论,在某些任务执行上已超越GPT-5.6。这意味着,模型智能的上限不仅在于其内部参数,还可以通过工程化手段从外部突破。智能模型网关通过提供混合推理系统,将每次模型调用转化为一场“专家会诊”。PPIO构建了从GPU集群到推理服务优化,再到应用场景深度理解的全栈式AI云能力,以实现极致效率。姚欣举例说明,针对人类对话、智能体调用和AI编程等不同场景,PPIO提供了定制化优化,满足它们在响应速度和精度上的不同需求。
PPIO的产品差异化还体现在快速集成、平台中立以及自研推理加速引擎。其平台支持接入200余款开源模型,用户切换模型仅需修改一行代码,这种中立定位赢得了开发者信任。PPIO的推理加速引擎深度优化了Agent调用模式的碎片化、高频化和连续性特征,其GPU利用率长期维持在75%以上,远高于行业平均水平。这得益于其分布式算力调度能力,通过打通全球算力节点,并利用时区错峰调度,实现了不同负载的高质量融合,从而显著提升了算力利用效率。
“Agentic Cloud”被视为下一波Token消耗的基础设施浪潮。继谷歌、阿里云、亚马逊和微软等巨头纷纷发布Agentic Cloud战略后,PPIO也在WAIC 2026上正式宣布了这一全新定位。姚欣认为,其核心逻辑是云的第一用户正从人类转向AI Agent。AI智能体的自主推理、工具调用和多步骤工作流,对云基础设施提出了持续、高频、密集消耗Token的新要求。他分享的数据显示,尽管人类使用AI仍有增长空间,但智能体的调用正呈指数级增长。PPIO内部,Agent已承担了近千项工作,实现了开发、运维、客服等环节的Agent化。
PPIO的Agentic Cloud产品架构分为基础设施层、模型服务层和Agent Harness平台层。Harness作为约束、指导、验证和纠错Agent执行的工程框架,包含了上下文构建、工具编排、验证循环、成本控制和可观测性等关键环节。其核心组件之一的沙箱,为Agent Harness提供了安全隔离的运行环境。PPIO Agent沙箱冷启动时延低于200ms,支持上万个沙箱同时创建,并且在任务空闲时可自动暂停计费,综合使用成本较同类产品降低90%以上。沙箱上线一年,业务规模已增长超过120倍。
目前,Token定价已呈现出编程最贵、智能体次之、对话服务最便宜的排序,这预示着未来Token消耗的主要方向。姚欣认为,PPIO服务的对象正从人类转向Agent乃至未来的机器人。这种转变正在重塑云计算商业模式,从过去比拼功能数量和生态封闭,转向为硅基生命提供更快、更便宜、更稳定的运行环境。PPIO选择拥抱开源,不做封闭花园,并致力于成为AI时代的互补者。Token经济正在重新定义算力的价值,而在这场重构中,效率最高者将赢得未来。
