本报记者 桂小笋
8月27日,海光信息技术股份有限公司(以下简称“海光信息”)发布行业首个“AgenttoToken开放计算架构”,依托中央处理器(CentralProcessingUnit,以下简称CPU)与深度计算处理器(DeepComputingUnit,以下简称DCU)双芯协同算力体系及全维度开放互连能力,构建起从底层芯片、算力调度到上层AI应用的全链路算力框架,精准适配智能体(Agent)商业化落地需求,为词元(Token)经济规模化、产业化发展筑牢国产自主算力底座。
在接受《证券日报》记者采访时,海光信息总裁助理兼服务器产品部总经理张攀勇、海光信息总裁助理兼智能计算产品部总经理杜夏威详细讲述了架构核心优势、产业变革逻辑及生态布局,解读了AI算力从峰值比拼向业务价值落地的产业新趋势。
打通闭环体系
随着大模型技术深度渗透实体产业,AI落地重心已从技术参数比拼转向真实业务赋能,具备自主决策、任务编排能力的Agent,成为打通大模型与行业场景的核心载体。业内普遍认为,词元作为串联业务需求、算力投入与服务产出的核心媒介,其生产效率、单位成本与供给稳定性,直接决定AI商业化落地的深度与速度,词元经济已然成为AI产业迭代的核心主线。
针对产业发展新需求与算力适配痛点,海光信息全新发布的“AgenttoToken开放计算架构”,完整覆盖词元经济全价值周期,成功打通“业务需求、智能体调度、词元生产、结果交付”闭环体系,精准匹配AgenticAI差异化、场景化的负载特征。
杜夏威告诉《证券日报》记者,AI产业正经历阶段性成熟蜕变,行业评判标准已彻底迭代,摆脱了单纯追求芯片峰值算力、模型参数量的内卷式竞争,转向以业务落地效果、词元稳定产出、算力投入产出比为核心的务实评价体系。相较于传统单芯片算力架构,此次新推出的架构,核心优势在于CPU+DCU双芯精准分工、协同赋能,重构了Agent全业务链路的算力供给模式,实现算力资源与AI业务场景的极致适配。
张攀勇告诉《证券日报》记者,Agent时代彻底重塑了CPU的产业价值与应用场景。过往AI算力体系中,算力重心集中在加速芯片,CPU多承担简单数据预处理工作。而在Agent商业化场景中,大量任务理解、工具调用、实时决策、并发调度、数据交互等复杂逻辑处理工作需要CPU支撑,CPU从“辅助算力”升级为“业务中枢”。DCU则聚焦词元生产核心环节,专注并行计算加速,高效承接批量解码、KV缓存优化、预处理加速、长序列场景支撑等高密度计算任务。
四大维度全面开放
立足产业规模化落地痛点,海光信息全新架构从算力、互连、安全、软件栈四大维度实现全面开放,构建起兼容适配、安全可信、生态互通的产业协同底座,破解异构资源协同难、模型迁移成本高、安全防护薄弱、生态适配不足等行业难题。
算力开放层面,架构支持海光信息双芯原生组合、异构芯片交叉适配等多元部署模式,可灵活适配不同行业、不同规模的词元生产需求;互连开放依托自研HSL高速互连协议,突破传统芯片交互带宽瓶颈,大幅提升芯片间数据传输与词元全链路流转效率;安全开放依托海光信息芯片级内生全栈安全能力,从硬件底层实现数据隔离、权限管控、加密防护,为Agent业务运行、词元全流程流转提供可信安全屏障;软件栈开放配套全栈开发工具链,适配百余种主流AI框架,大幅降低大模型迁移、二次开发与商业化部署门槛。
在降低行业AI落地成本、激活产业生态活力方面,杜夏威介绍,海光信息坚持双轮驱动生态建设。一方面持续迭代自研软件栈,另一方面坚持开放开源路线。
据了解,依托海光产业生态合作组织产业生态,海光信息将持续联动整机、软件、行业终端等合作伙伴深化产品适配,推动国产CPU、DCU及各类加速卡实现统一调度、协同算力。行业用户可复用现有硬件设备,根据业务增长节奏分阶段扩容升级,有效降低数字化转型成本,推动国产算力高效赋能实体产业。
(编辑 乔川川)