PPIO亮相AICC算力大会:以智能Token工厂打造Agent时代的智能生产线
欢迎订阅《信阳手机报》移动用户发送短信 XYSJB 到10658300即可开通 3元/月 不收GPRS流量费

近日,PPIO 受邀参加 AICC 2026 人工智能计算大会。
PPIO 研发副总裁李星星发表了题为《PPIO 的 Token 工厂与智能模型网关实践》的主题演讲,分享了 PPIO 在智能模型网关、推理加速引擎、全球算力调度与 Agent 沙箱等核心能力,系统阐述了面向 Agent 时代的智能 Token 工厂方法论与全球化实践。

从人使用 Token,到 Agent 使用 Token
Token 工厂这一概念由英伟达较早提出,今年以来随着 AI 产业的高速发展,Token 工厂正式进入爆发期。李星星指出,5G 时代比拼的是手机流量,AI 时代比拼的则是 Token。
来自工业和信息化部、国家数据局的最新数据显示,截至 2026 年 6 月,我国日均 Token 调用量已突破 500 万亿,较 2024 年增长约 5000 倍。在 OpenRouter 全球平台上,中国开源模型的 Token 调用量连续多周超越美国模型,位居全球第一。
李星星总结了 Token 爆发的双重驱动力。第一重驱动力,来自于大模型智能的持续跃升以及成本的断崖式下降。以海外模型为例,Anthropic 与 OpenAI 正在 SOTA 模型上激烈竞逐,接连攻克多项长期悬而未决的数学难题。与此同时,行业 Token 价格较 GPT-3.5/4 时代已下降约 100 至 200 倍,单价跌破 1 美元/百万 Token,AI 推理全面进入普惠阶段。

第二重驱动力,则来自于 Agent 的爆发。Hermes Agent、OpenClaw 这类 Agent 产品已经成为 Openrouter 平台最大的 Token 消耗方,PPIO 平台上的 Token 消耗也以 Agent 任务为主。
Agent 使用云的行为模式与人类截然不同。传统云服务以“请求—响应”的同步交互为主,使用节奏与人的作息一致;而 Agent 被交付复杂任务后可以持续自主探索,任务时长从分钟级的对话、10 分钟级的 PPT 生成,延伸到小时级、天级乃至周级的复杂调研,并具备自主重试、策略调整与自我纠错能力。
“云基础设施需要被重新定义——从为人提供资源转向为 Agent 提供智能生产环境。”李星星总结道。
PPIO 智能 Token 工厂:为Agent时代打造智能生产线
针对 Agent 时代的智能新命题,PPIO 提出了“智能 Token 工厂”的系统性解法,并给出一条生产力公式:Agent 生产力 = Token 智能密度 × Agent Loop 时长。Token 智能密度指单位 Token 所携带的智能总量,Agent Loop 时长则对应任务复杂度。

围绕这一公式,PPIO 的智能 Token 工厂构建了以下核心能力:
一是智能模型网关。 面对累计已上架数百款模型带来的“选择困难”,PPIO 把繁复的评测榜单内化进网关,根据用户输入内容与使用场景(写作、Coding 等)自动调度不同模型,用 Auto 智能调度与 Fusion 融合模型“双引擎”分工协作。
Auto 模式按任务复杂度动态路由最优模型,简单任务用轻量模型、复杂任务用强模型,辅以冗余上下文压缩、预算护栏与失败回退机制,实测可节省 60% 的 Token 开销。
Fusion 模式则将一次请求同时分发给多个专家模型并行作答,通过思考编排与交叉验证融合生成最终答案,用约 1/10 的成本实现了旗舰模型的智能水平。

“我们不是卖最贵的‘超级模型’,也不是卖最便宜的‘乞丐模型’,而是用工程化手段,把模型的‘智商分’稳定在头部梯队,同时把价格打到中低梯队。”李星星表示,这正是智能模型网关“Auto 调度降本 + Fusion 会诊提质”方法论的核心价值。
二是推理加速引擎。 PPIO 从算子优化到推理加速实现全栈自研,通过 PD 分离、KV Cache 优化、批处理调度、显存管理等核心技术,在同等硬件条件下实现更高吞吐与更低延迟,可实现 300% 的吞吐提升,性能超越模型原厂与开源社区。
PPIO 在今年 6 月入选中国信息通信研究院 Token 服务能力攀登计划,在通用场景下 PPIO 模型服务可实现 TPS ≥55 个/秒、TTFT ≤0.9 秒、调用成功率 ≥99.9%。
三是全球算力调度。 PPIO 构建了全球算力网络,覆盖 6 大洲、5000+ 节点、1500+ 县市。PPIO 利用东西半球的峰谷差实现算力跨时区潮汐复用,智能调度系统根据实时负载、网络延迟、电力成本等多维因素动态分配推理任务,GPU 平均利用率达 75% 以上,远高于行业平均水平。

四是 Agent Harness 与安全沙箱。 通过统一封装工具调用、支持 ReAct、Plan-and-Execute 等多步推理编排以及分层记忆管理,配合虚拟机级隔离的沙箱执行环境、细粒度权限管控和全链路审计,让 Agent 真正从“会说”走向“会做”。
李星星指出,当前主流的 Agent Harness 产品大多只能在本地运行,PPIO 做的一件事是把 Harness 搬到云端——复杂任务可以 24 小时连续不间断执行,用户甚至能用手机管理任务,无需本地电脑长期开机;同时所有运行都在云端隔离沙箱内完成,支持大量试错、代码编写与验证,不安全操作被限制在独立环境中。目前已有不少大模型厂商使用 PPIO 的安全沙箱进行强化学习验证,沙箱推出一年后已实现超百倍增长。

Token 出海,PPIO 的技术全球化实践
李星星还分享了 PPIO 的全球化布局与中国 AI 技术出海实践。
PPIO 通过东西半球潮汐调度实现算力跨半球流动——亚洲白天高峰调度至美洲夜间低谷、欧洲高峰调度至亚太夜间,实现全球算力利用率最大化;同时以 200+ 主流模型的多语言多模型支持、遵循各地区数据保护法规的本地化部署方案,服务全球开发者生态。
PPIO 深度融入全球 AI 开源生态,与 GitHub、Hugging Face、OpenRouter、vLLM、SGLang 等全球主流开发者社区建立紧密合作,与数十家 AI 工具与产品完成生态对接合作。
李星星表示,从互联网、移动互联网时代“产品创新在中国、技术创新在美国”的格局,到 AI 时代中国的技术能力同样强劲、并更多面向全球输出,PPIO 希望把 Token 工厂的服务带到全世界。PPIO 的全球化实践证明,中国 AI 企业不仅能在本土市场取得成功,更能通过技术创新和基础设施布局参与全球 AI 产业竞争。智能 Token 工厂模式为中国 AI 技术出海提供了可复制的基础设施范式。
PPIO 致力于构建面向 Agent 时代的智能 Token 工厂,以技术创新驱动 AI 产业可持续发展,让智能算力像水电一样普惠可用,与行业伙伴和开发者社区共创智能未来。
文章投诉热线:156 0057 2229 文章投诉邮箱:291 3236@qq.com
标签:
- 上一篇:聚焦安居与片区更新 白云城市广场WT-2地块开工
- 下一篇:没有了
报晓风
信阳日报微信
掌上信阳微信
信阳日报新浪微博
信阳日报腾讯微博
请您文明上网、理性发言,并遵守相关规定。网友评论
网友评论仅供其表达个人看法,并不表明信阳新闻网立场。



