本报讯 (记者袁传玺)
7月17日,2026世界人工智能大会(WAIC)在上海举行。派想未来集团(以下简称“PPIO”)正式发布全新Agentic Cloud(智能体云)定位及智能模型网关新品。PPIO联合创始人兼CEO姚欣对《证券日报》记者表示,“Agent(智能体)时代最重要的变化,就是云的第一客户从人变成了Agent。过去的云计算是为人使用软件而设计,而Agentic Cloud是为Agent自主运行而生。”
姚欣进一步阐释,PPIO正致力于打造面向Agent时代的智能Token(词元)工厂。自2024年推出模型服务以来,PPIO的“Token工厂”业务规模飞速增长,截至2026年6月日均Token调用量超1.2万亿,较2025年同期增长超8倍。
“今年二三月的时候,Token消耗的增长曲线非常陡峭,因为存在大量的尝鲜式应用。但经过一波尝鲜降温后,现在进入到了稳健的增长阶段,每个月可以看到大约10%到20%的持续增长,全年大概有三到四倍的增幅,并且已经变成了真正生产力的工具。”姚欣表示,PPIO的Token消耗曲线与企业付费的真实曲线高度吻合——“PPIO是ToB(面向企业)公司,平台上所有Token都是付费的,这不是C端(消费者端)用户免费尝鲜的曲线,而是企业付费的真实曲线。”
从模型Scaling Law到智能体Scaling Law
万亿Token背后的范式跃迁
在姚欣看来,当前AI行业正经历从“模型Scaling Law(缩放定律)”向“智能体Scaling Law”的范式转换。他提出Agent时代的核心公式——Agent生产力=Token智能密度×Agent Loop(智能体循环)时长。Token智能密度决定了Agent每一步决策的质量上限,Agent Loop时长决定了Agent能持续运行多久、完成多复杂的任务。
“模型本身的智能能力提升速度在放缓。大家都能感觉到从GPT-3到GPT-4,再到GPT-5的时候,效果是惊艳的;但从GPT-5到GPT-5.2再到GPT-5.4,差别就没那么大了,只有10%到20%的提升。”姚欣表示,“这也是为什么开源和闭源的差距开始缩短,因为最领先的闭源模型迭代速度放缓了。但人类还有大量任务是AI解决不了的,比如复杂计算、复杂决策,甚至做CEO这件事。”
围绕这一公式,PPIO Agentic Cloud构建了两层原生产品体系。第一层是智能模型网关,作为AI Agent的智能调度中心,关键决策由混合模型把关提升质量,简单任务由模型调度自动分流到轻量模型,确保Agent用最低的Token成本、最高的智能性能把任务完成。第二层是Agent Harness(智能体执行框架)层,融合沙箱、任务编排、ToolUse(工具调用)、记忆管理等于一体,延长Agent可持续运行的Loop时长以解决复杂长程任务。
“Agent不能只‘想’,还要能‘做’。”姚欣表示,Harness是专门用于约束、指导、验证和纠错Agent执行的工程框架,涵盖上下文构建、工具编排、验证循环、成本控制和可观测性等除大模型本身之外的所有环节。去年,PPIO推出了国内首款兼容E2B接口的Agent沙箱,冷启动时延低于200ms(毫秒),采用系统级安全隔离,支持上万个沙箱同时创建,综合使用成本较同类产品降低90%以上,上线一年业务规模已增长超120倍。
智能模型网关
用“三个臭皮匠”凑出“99号汽油”
针对当前AI应用开发者过度依赖“全能型”大模型的痛点,PPIO最新发布的智能模型网关提供了全新解法。“我们会帮你把92号、95号、98号凑在一起,得出一个99号,这就是我们的混合模型。”姚欣表示。
与市面上常见的、仅做简单“请求转发”的API(应用程序编程接口)网关不同,PPIO以智能优先,兼顾性价比。智能模型网关的第一个功能是混合模型,在处理高价值、高风险或结果不确定的关键Agent步骤时,网关会触发“多模型融合”机制,将问题同时分发给多个专家模型,通过交叉验证和融合生成最终答案。
“三个臭皮匠顶个诸葛亮。”姚欣如此形容这一机制。在DRACO深度研究基准测试中,PPIO通过融合Mimo-V2.5-Pro、Kimi-K2.7和GLM-5.2进行混合模型推理,可以将性能提升至接近Claude Fable5的水平,而成本却仅是Claude Fable5的七分之一。据综合测算,PPIO智能模型网关可以将智能水平提升20%,将成本降低50%-60%。
智能模型网关的第二个功能是模型调度,根据任务类型进行智能路由,压缩冗余上下文、复用计算结果,设置预算护栏和失败回退机制。“我们的调度模型本质上就是一个小模型,是拿我们大量的平台上的调度数据得出的。”姚欣表示,它不是自己定义出来的,而是机器学习训练出来的。针对天气查询这类轻量化简单任务,系统将调度DeepSeek轻量化Flash模型完成运算,无需启用算力成本更高的Pro专业版模型。
这一能力背后,是对Agent时代模型调用逻辑的重新思考。不同于人类用户偶尔提问的使用模式,智能体应用的兴起正在推动Token消耗呈指数级增长。Agent的运行天然具备高频工具调用、长上下文持续交互、多模型协同等特征,对延迟、稳定性和成本敏感度远高于传统场景。
面向全球,PPIO同步布局即开即用的“Token出海”服务,依托覆盖全球6大洲、11大核心区域的5000+分布式算力节点,构建低时延、高带宽、高可用的算力网络。“海外Token价格比国内平均要高30%,我们比起主要的国际云服务商,平均收费低40%。”姚欣表示,“国内竞争太激烈了,我们还是希望企业有合理的经营,不想为了冲数字去冲短期行为。”
“未来Token消耗的99%都不是人,而是Agent。”姚欣表示,“PPIO要预先抢占这个未来的卡位——今天生产大量的高质量Token,同时占领智能体,让大量智能体的底层不仅用我们的Token,还在用我们的沙箱,用我们的Harness服务。我们希望做的事情很简单,让中国AI企业在海外开疆拓土的时候,不用自己先花几个亿去修路、搭基建。PPIO把路修好,企业只管开车上路,创造无限价值。”
(编辑 黄力)