证券日报微信

证券日报微博

您所在的位置: 网站首页 > 公司产业 > 上市公司 > 正文

国产处理器架构突围 华东地区首个国产TPU千卡智算集群项目落地

2026-07-23 15:15  来源:证券日报网 

    本报记者贾丽

    在近日举行的2026世界人工智能大会(WAIC2026)期间,一场关于AI算力“性价比”的静默变革正在发生。当大多数厂商仍在通用处理器(GPU)的赛道上通过堆叠制程和参数来争夺算力高地时,中昊芯英(杭州)科技有限公司(以下简称“中昊芯英”)选择了一条更为垂直的道路。

    WAIC2026上,中昊芯英带来了第二代全自研高性能TPU(张量处理器)“须臾”及配套的泰则2.0智算平台。同时,中昊芯英宣布,公司联合中国电信股份有限公司杭州分公司(以下简称“杭州电信”)、中兴通讯股份有限公司(以下简称“中兴通讯”)联合打造的华东地区(杭州)首个国产TPU千卡智算集群项目正式落地,成为国内国产TPU规模化智算基础设施建设代表,让算力不仅“强得起”,更要“用得起”。

    那么,产业链企业在算力关键支撑国产处理器架构上如何突围,怎样进行软件国产化生态搭建,为数字经济高质量发展筑牢自主算力底座,近日,中昊芯英创始人、CEO杨龚轶凡接受了《证券日报》记者专访。

    算力提升3倍

    成本却砍半

    第二代“须臾”处理器是国产架构在AI专用赛道(TPU)上实现技术自主突围的典型代表,其重要性在于打破了X86等传统海外架构的路径依赖,为国内算力供应链安全提供了“差异化+全自主”的关键底座。

    “加量不加价。”这是中昊芯英创始人、CEO杨龚轶凡对第二代“须臾”处理器的最直观总结。

    据中昊芯英联合创始人、CTO郑瀚寻介绍,相较于2023年量产的第一代“刹那”处理器,“须臾”的综合算力性能提升了3倍以上。这种显著的性能飞跃并非单纯依赖制程工艺的升级,而是源于“软件驱动硬件架构”的设计。

    郑瀚寻拆解了其中的技术逻辑,通过重构矩阵计算核心单元和优化计算流水线,大幅提升了基础算子的执行效率;采用了双芯粒同基板封装技术,两颗芯粒协同并行运算,直接释放了双倍算力;通过扩容片上高速存储,减少了跨处理器读写带来的延迟与损耗。

    值得注意的是,在实现性能3倍跃升的同时,“须臾”的整体功耗并未明显上涨。这意味着综合运营成本的骤降。杨龚轶凡算了一笔账:在同等算力输出规模下,直接部署二代“须臾”处理器,其硬件采购成本仅为一代集群的二分之一至三分之一。结合软硬件协同优化,企业搭建智算中心的总运营成本可直接降低50%。

    “我们的目标是让智能体的使用成本降低。”杨龚轶凡表示,只有当算力成本降到一定的临界点,AI才能真正变为千行百业通用的生产力工具。

    在处理器架构路线上

    走出差异化

    在全球AI计算领域,通用处理器(GPU)长期占据主导地位。然而,随着大模型商业化进入深水区,传统处理器架构在处理特定任务时的局限性日益凸显。

    中昊芯英坚持自研TPU处理器架构,这在国内算力厂商中属于少数派。杨龚轶凡指出,TPU处理器架构天然适配大语言模型。特别是在当前备受关注的词元经济和智能体应用场景中,输入词元规模往往远高于输出,两者差距甚至可达万倍。这种极端不均衡的输入输出特征,让传统通用处理器架构显得力不从心。

    杨龚轶凡解释道,这种架构级的优势,使得中昊芯英能够采用比竞品更低的生产制程,实现持平甚至更优的算力性能。

    这种差异化竞争力在集群部署层面尤为明显。此次WAIC期间,中昊芯英宣布了与杭州电信、中兴通讯联合打造的华东地区首个国产TPU千卡智算集群落地。相比部分国际企业在技术上侧重小规模互联,中昊芯英采用了3DTorus(三维环面)拓扑结构,专为上百颗处理器的同步并行运算设计,在大规模集群环境下通信延迟更低。

    三方依托各自在自研TPUAI芯片、全栈通信方案、算力运营领域的技术积累,构建起从底层芯片设计、服务器集成部署到算力平台运营服务的完整闭环,打造出“自主芯片+全栈集成+智能运营”的新一代智算体系。

    从“可用”到“好用”

    加速生态建设

    长期以来,国产算力处理器面临着“软硬件生态薄弱”和“客户使用门槛高”两大痛点。对于这一问题,杨龚轶凡有着清醒的认识。

    “过去三年,我们从0到1走完了软件国产化搭建,现在的核心目标是从‘可用’迈向‘好用’阶段。”杨龚轶凡坦言。

    据了解,目前,DeepSeek等国内主流开源大模型均已在“须臾”处理器上完成了基础功能适配。

    这种务实策略也反映在客户选择上。目前,中昊芯英的核心落地赛道集中在语言类大模型,客户群体涵盖政府、三大运营商、大模型研发企业以及主流服务器厂商。对于政企客户而言,“自主可控”是采购的硬性门槛,而中昊芯英高达100%自研的指令集和全栈软件链路,恰好满足了这一刚需。

    谈及未来三到五年的规划,杨龚轶凡表示,搭建万卡级智算集群与推动TPU处理器成为国家算力基础设施的主流选择并不冲突。

    “我们必然要推进万卡集群建设,同时从商业化落地中沉淀工程经验。”杨龚轶凡透露,预计未来1-2年,中昊芯英将逐步缩小与国际一线厂商最先进代际处理器的差距。

    从2018年团队回国创业,到2023年第一代“刹那”处理器落地,再到如今“须臾”性能的3倍跃升,中昊芯英用8年时间验证了TPU处理器路线在中国市场的可行性。在杨龚轶凡的蓝图中,TPU处理器是通用、主流且自主可控的算力基座。“须臾”处理器的量产与千卡集群的落地,也将加快国产TPU生态爆发期的来临。

    首都企业改革与发展研究会理事肖旭在接受《证券日报》记者采访时表示,国产TPU千卡智算集群是国产算力基础设施实现了从“技术突破”到“商业落地”的关键跨越,一定程度上解决了算力“强得起”更“用得起”的产业化难题。产业链企业应该联合通过软硬件全栈国产化构建算力产业硬核底座。

(编辑 才山丹)

-证券日报网

版权所有《证券日报》社有限责任公司

互联网新闻信息服务许可证 10120240020增值电信业务经营许可证 京B2-20250455

京公网安备 11010602201377号京ICP备19002521号

证券日报网所载文章、数据仅供参考,使用前务请仔细阅读法律申明,风险自负。

证券日报社电话:010-83251700网站电话:010-83251800

网站传真:010-83251801电子邮件:xmtzx@zqrb.net

官方客户端

安卓

IOS

官方微信

扫一扫,加关注

官方微博

扫一扫,加关注