ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

PPIO亮相AICC算力大会:以智能Token工厂打造Agent时代的智能生产线

PPIO亮相AICC算力大会:以智能Token工厂打造Agent时代的智能生产线 近日PPIO 受邀参加 AICC 2026 人工智能计算大会。PPIO 研发副总裁李星星发表了题为《PPIO 的 Token 工厂与智能模型网关实践》的主题演讲分享了 PPIO 在智能模型网关、推理加速引擎、全球算力调度与 Agent 沙箱等核心能力系统阐述了面向 Agent 时代的智能 Token 工厂方法论与全球化实践。Token 工厂这一概念由英伟达较早提出今年以来随着 AI 产业的高速发展Token 工厂正式进入爆发期。李星星指出5G 时代比拼的是手机流量AI 时代比拼的则是 Token。来自工业和信息化部、国家数据局的最新数据显示截至 2026 年 6 月我国日均 Token 调用量已突破 500 万亿较 2024 年增长约 5000 倍。在 OpenRouter 全球平台上中国开源模型的 Token 调用量连续多周超越美国模型位居全球第一。李星星总结了 Token 爆发的双重驱动力。第一重驱动力来自于大模型智能的持续跃升以及成本的断崖式下降。以海外模型为例Anthropic 与 OpenAI 正在 SOTA 模型上激烈竞逐接连攻克多项长期悬而未决的数学难题。与此同时行业 Token 价格较 GPT-3.5/4 时代已下降约 100 至 200 倍单价跌破 1 美元/百万 TokenAI 推理全面进入普惠阶段。第二重驱动力则来自于 Agent 的爆发。Hermes Agent、OpenClaw 这类 Agent 产品已经成为 Openrouter 平台最大的 Token 消耗方PPIO 平台上的 Token 消耗也以 Agent 任务为主。Agent 使用云的行为模式与人类截然不同。传统云服务以“请求—响应”的同步交互为主使用节奏与人的作息一致而 Agent 被交付复杂任务后可以持续自主探索任务时长从分钟级的对话、10 分钟级的 PPT 生成延伸到小时级、天级乃至周级的复杂调研并具备自主重试、策略调整与自我纠错能力。“云基础设施需要被重新定义——从为人提供资源转向为 Agent 提供智能生产环境。”李星星总结道。针对 Agent 时代的智能新命题PPIO 提出了“智能 Token 工厂”的系统性解法并给出一条生产力公式Agent 生产力 Token 智能密度 × Agent Loop 时长Token 智能密度指单位 Token 所携带的智能总量Agent Loop 时长则对应任务复杂度。围绕这一公式PPIO 的智能 Token 工厂构建了以下核心能力一是智能模型网关。面对累计已上架数百款模型带来的“选择困难”PPIO 把繁复的评测榜单内化进网关根据用户输入内容与使用场景写作、Coding 等自动调度不同模型用 Auto 智能调度与 Fusion 融合模型“双引擎”分工协作。Auto 模式按任务复杂度动态路由最优模型简单任务用轻量模型、复杂任务用强模型辅以冗余上下文压缩、预算护栏与失败回退机制实测可节省 60% 的 Token 开销。Fusion 模式则将一次请求同时分发给多个专家模型并行作答通过思考编排与交叉验证融合生成最终答案用约 1/10 的成本实现了旗舰模型的智能水平。“我们不是卖最贵的‘超级模型’也不是卖最便宜的‘乞丐模型’而是用工程化手段把模型的‘智商分’稳定在头部梯队同时把价格打到中低梯队。”李星星表示这正是智能模型网关“Auto 调度降本 Fusion 会诊提质”方法论的核心价值。二是推理加速引擎。PPIO 从算子优化到推理加速实现全栈自研通过 PD 分离、KV Cache 优化、批处理调度、显存管理等核心技术在同等硬件条件下实现更高吞吐与更低延迟可实现 300% 的吞吐提升性能超越模型原厂与开源社区。PPIO 在今年 6 月入选中国信息通信研究院 Token 服务能力攀登计划在通用场景下 PPIO 模型服务可实现 TPS ≥55 个/秒、TTFT ≤0.9 秒、调用成功率 ≥99.9%。三是全球算力调度。PPIO 构建了全球算力网络覆盖 6 大洲、5000 节点、1500 县市。PPIO 利用东西半球的峰谷差实现算力跨时区潮汐复用智能调度系统根据实时负载、网络延迟、电力成本等多维因素动态分配推理任务GPU 平均利用率达 75% 以上远高于行业平均水平。四是 Agent Harness 与安全沙箱。通过统一封装工具调用、支持 ReAct、Plan-and-Execute 等多步推理编排以及分层记忆管理配合虚拟机级隔离的沙箱执行环境、细粒度权限管控和全链路审计让 Agent 真正从“会说”走向“会做”。李星星指出当前主流的 Agent Harness 产品大多只能在本地运行PPIO 做的一件事是把 Harness 搬到云端——复杂任务可以 24 小时连续不间断执行用户甚至能用手机管理任务无需本地电脑长期开机同时所有运行都在云端隔离沙箱内完成支持大量试错、代码编写与验证不安全操作被限制在独立环境中。目前已有不少大模型厂商使用 PPIO 的安全沙箱进行强化学习验证沙箱推出一年后已实现超百倍增长。李星星还分享了 PPIO 的全球化布局与中国 AI 技术出海实践。PPIO 通过东西半球潮汐调度实现算力跨半球流动——亚洲白天高峰调度至美洲夜间低谷、欧洲高峰调度至亚太夜间实现全球算力利用率最大化同时以 200 主流模型的多语言多模型支持、遵循各地区数据保护法规的本地化部署方案服务全球开发者生态。PPIO 深度融入全球 AI 开源生态与 GitHub、Hugging Face、OpenRouter、vLLM、SGLang 等全球主流开发者社区建立紧密合作与数十家 AI 工具与产品完成生态对接合作。李星星表示从互联网、移动互联网时代“产品创新在中国、技术创新在美国”的格局到 AI 时代中国的技术能力同样强劲、并更多面向全球输出PPIO 希望把 Token 工厂的服务带到全世界。PPIO 的全球化实践证明中国 AI 企业不仅能在本土市场取得成功更能通过技术创新和基础设施布局参与全球 AI 产业竞争。智能 Token 工厂模式为中国 AI 技术出海提供了可复制的基础设施范式。PPIO 致力于构建面向 Agent 时代的智能 Token 工厂以技术创新驱动 AI 产业可持续发展让智能算力像水电一样普惠可用与行业伙伴和开发者社区共创智能未来。
返回列表