PPIO亮相AICC算力大会:以智能Token工厂打造Agent时代的智能生产线

分享
PPIO亮相AICC算力大会:以智能Token工厂打造Agent时代的智能生产线

近日,PPIO 受邀参加 AICC 2026 人工智能计算大会。

PPIO 研发副总裁李星星发表了题为《PPIO 的 Token 工厂与智能模型网关实践》的主题演讲,分享了 PPIO 在智能模型网关、推理加速引擎、全球算力调度与 Agent 沙箱等核心能力,系统阐述了面向 Agent 时代的智能 Token 工厂方法论与全球化实践。

从人使用 Token,到 Agent 使用 Token

Token 工厂这一概念由英伟达较早提出,今年以来随着 AI 产业的高速发展,Token 工厂正式进入爆发期。李星星指出,5G 时代比拼的是手机流量,AI 时代比拼的则是 Token。

来自工业和信息化部、国家数据局的最新数据显示,截至 2026 年 6 月,我国日均 Token 调用量已突破 500 万亿,较 2024 年增长约 5000 倍。在 OpenRouter 全球平台上,中国开源模型的 Token 调用量连续多周超越美国模型,位居全球第一。

李星星总结了 Token 爆发的双重驱动力。

第一重驱动力,来自于大模型智能的持续跃升以及成本的断崖式下降。以海外模型为例,Anthropic 与 OpenAI 正在 SOTA 模型上激烈竞逐,接连攻克多项长期悬而未决的数学难题。与此同时,行业 Token 价格较 GPT-3.5/4 时代已下降约 100 至 200 倍,单价跌破 1 美元/百万 Token,AI 推理全面进入普惠阶段。

第二重驱动力,则来自于 Agent 的爆发。Hermes Agent、OpenClaw 这类 Agent 产品已经成为 Openrouter 平台最大的 Token 消耗方,PPIO 平台上的 Token 消耗也以 Agent 任务为主。

Agent 使用云的行为模式与人类截然不同。传统云服务以“请求—响应”的同步交互为主,使用节奏与人的作息一致;而 Agent 被交付复杂任务后可以持续自主探索,任务时长从分钟级的对话、10 分钟级的 PPT 生成,延伸到小时级、天级乃至周级的复杂调研,并具备自主重试、策略调整与自我纠错能力。

“云基础设施需要被重新定义——从为人提供资源转向为 Agent 提供智能生产环境。”李星星总结道。

PPIO 智能 Token 工厂:为Agent时代打造智能生产线

针对 Agent 时代的智能新命题,PPIO 提出了“智能 Token 工厂”的系统性解法,并给出一条生产力公式:Agent 生产力 = Token 智能密度 × Agent Loop 时长。Token 智能密度指单位 Token 所携带的智能总量,Agent Loop 时长则对应任务复杂度。

围绕这一公式,PPIO 的智能 Token 工厂构建了以下核心能力:

一是智能模型网关。 面对累计已上架数百款模型带来的“选择困难”,PPIO 把繁复的评测榜单内化进网关,根据用户输入内容与使用场景(写作、Coding 等)自动调度不同模型,用 Auto 智能调度与 Fusion 融合模型“双引擎”分工协作。

Auto 模式按任务复杂度动态路由最优模型,简单任务用轻量模型、复杂任务用强模型,辅以冗余上下文压缩、预算护栏与失败回退机制,实测可节省 60% 的 Token 开销。

Fusion 模式则将一次请求同时分发给多个专家模型并行作答,通过思考编排与交叉验证融合生成最终答案,用约 1/10 的成本实现了旗舰模型的智能水平。

“我们不是卖最贵的‘超级模型’,也不是卖最便宜的‘乞丐模型’,而是用工程化手段,把模型的‘智商分’稳定在头部梯队,同时把价格打到中低梯队。”李星星表示,这正是智能模型网关“Auto 调度降本 + Fusion 会诊提质”方法论的核心价值。

二是推理加速引擎。 PPIO 从算子优化到推理加速实现全栈自研,通过 PD 分离、KV Cache 优化、批处理调度、显存管理等核心技术,在同等硬件条件下实现更高吞吐与更低延迟,可实现 300% 的吞吐提升,性能超越模型原厂与开源社区。

PPIO 在今年 6 月入选中国信息通信研究院 Token 服务能力攀登计划,在通用场景下 PPIO 模型服务可实现 TPS ≥55 个/秒、TTFT ≤0.9 秒、调用成功率 ≥99.9%。

三是全球算力调度。 PPIO 构建了全球算力网络,覆盖 6 大洲、5000+ 节点、1500+ 县市。PPIO 利用东西半球的峰谷差实现算力跨时区潮汐复用,智能调度系统根据实时负载、网络延迟、电力成本等多维因素动态分配推理任务,GPU 平均利用率达 75% 以上,远高于行业平均水平。

四是 Agent Harness 与安全沙箱。 通过统一封装工具调用、支持 ReAct、Plan-and-Execute 等多步推理编排以及分层记忆管理,配合虚拟机级隔离的沙箱执行环境、细粒度权限管控和全链路审计,让 Agent 真正从“会说”走向“会做”。

李星星指出,当前主流的 Agent Harness 产品大多只能在本地运行,PPIO 做的一件事是把 Harness 搬到云端——复杂任务可以 24 小时连续不间断执行,用户甚至能用手机管理任务,无需本地电脑长期开机;同时所有运行都在云端隔离沙箱内完成,支持大量试错、代码编写与验证,不安全操作被限制在独立环境中。目前已有不少大模型厂商使用 PPIO 的安全沙箱进行强化学习验证,沙箱推出一年后已实现超百倍增长。

Token 出海,PPIO 的技术全球化实践

李星星还分享了 PPIO 的全球化布局与中国 AI 技术出海实践。

PPIO 通过东西半球潮汐调度实现算力跨半球流动——亚洲白天高峰调度至美洲夜间低谷、欧洲高峰调度至亚太夜间,实现全球算力利用率最大化;同时以 200+ 主流模型的多语言多模型支持、遵循各地区数据保护法规的本地化部署方案,服务全球开发者生态。

PPIO 深度融入全球 AI 开源生态,与 GitHub、Hugging Face、OpenRouter、vLLM、SGLang 等全球主流开发者社区建立紧密合作,与数十家 AI 工具与产品完成生态对接合作。

李星星表示,从互联网、移动互联网时代“产品创新在中国、技术创新在美国”的格局,到 AI 时代中国的技术能力同样强劲、并更多面向全球输出,PPIO 希望把 Token 工厂的服务带到全世界。PPIO 的全球化实践证明,中国 AI 企业不仅能在本土市场取得成功,更能通过技术创新和基础设施布局参与全球 AI 产业竞争。智能 Token 工厂模式为中国 AI 技术出海提供了可复制的基础设施范式。

PPIO 致力于构建面向 Agent 时代的智能 Token 工厂,以技术创新驱动 AI 产业可持续发展,让智能算力像水电一样普惠可用,与行业伙伴和开发者社区共创智能未来。

阅读更多

PPIO Agentic Cloud 是什么?从 Claude Projects 看 Agent 的运行底座

PPIO Agentic Cloud 是什么?从 Claude Projects 看 Agent 的运行底座

PPIO Agentic Cloud 是 PPIO 面向 AI Agent 构建、部署与运行提出的云服务体系。 2026 年 7 月,PPIO 用智能模型网关与 Agent Harness 两个功能侧解释这一体系:前者负责模型与 Token 的选择、调度和治理,后者关注长程任务中的上下文、工具与执行循环;PPIO Sandbox 是 Harness 的核心组件之一。 这套体系回答的是一个越来越具体的问题:当 Agent 不再只完成一次问答,而要持续调用工具、处理文件、执行代码并交付结果时,模型之外还需要什么? 当对话成为入口,Project 成为工作对象 2026 年 9 月 17 日,Anthropic 重新设计了 Claude

By luigi
PPIO 沙箱支持接入 OpenAI Agents API:一键托管 Agent Harness

PPIO 沙箱支持接入 OpenAI Agents API:一键托管 Agent Harness

近期,OpenAI 发布了一个重要的 API 产品:Agents API,把驱动 Codex 和 ChatGPT for Work 的 Harness 基础设施开放给了所有开发者。 这是 OpenAI 最新一代的智能体托管方案。用户只需通过一次 Agents API 调用,指定任务、模型、工具和环境参数,即可创建出可投入实际使用的智能体。 作为国内领先的独立 Agentic Cloud 服务商,PPIO 沙箱已在第一时间完成对 Agents API 的支持接入,成为不可或缺的 Harness 基础设施组件。 国内开发者从今天起可以在 OpenAI 这套全新范式上跑智能体,并自主选择 PPIO 沙箱作为智能体运行环境。 一次 API 调用,换来一个“数字员工”

By luigi
DeepSeek V4.1-Flash 更新后,企业如何管理模型版本、成本与稳定性?

DeepSeek V4.1-Flash 更新后,企业如何管理模型版本、成本与稳定性?

导语: 2026 年 9 月 10 日,DeepSeek 发布 V4.1-Flash,原 V4 Flash 与 V4 Flash Vision Exp 下线,旧模型名称暂时路由至新模型,API 价格同步调整。对于已经把模型 API 用到生产环境的企业而言,这不只是一次模型上新,更是一次需要验证质量、成本与可用性的生产变更。 模型迭代越来越快,企业面临的核心问题也在变化:过去关注的是“能否接入一个模型”,现在更需要回答“模型变化后,业务是否仍然稳定”。 PPIO 已上线 DeepSeek V4.1-Flash,企业可前往 模型详情页 查看模型信息与接入说明。PPIO 模型服务提供大语言模型和多模态模型 API,智能模型网关支持智能路由与多模型混合推理,

By luigi
PPIO加入中国信通院“算力超银生态共建计划”,探索Token普惠新模式

PPIO加入中国信通院“算力超银生态共建计划”,探索Token普惠新模式

2026 年 9 月 2 日,2026 开放数据中心大会暨首届算博会正式(ODX)在国家会议中心二期盛大开幕,由中国信通院发起的“算力超银生态共建计划”首批生态共建伙伴正式发布。 派欧云计算(上海)有限公司(下面简称 PPIO )作为上海市两家算力超银生态共建伙伴之一正式签约加入该计划,PPIO 董事孔杰受邀参加发布仪式。 后续 PPIO 将围绕“算力超市”、“算力银行”两大创新模式开展研究,探索适配大模型时代的算力交易与资源调度新模式。 “算力超市”方向:搭建或依托现有算力平台,通过“算模数用”测评机制认定资源的商品化展示、标准化计价、在线交易与自动交付,推行按“卡时”“核时”及“Token”计费等灵活计费方式,支持中小企业按需采购、随用随付。 “算力银行”方向:建立算力资源“存入—计费—支取—

By luigi