证券日报微信

证券日报微博

您所在的位置: 网站首页 > TMT频道 > TMT行业 > 正文

Coding之后 智谱押注了一个付费意愿更强的市场

2026-08-14 19:31  来源:证券日报网 

    本报讯 (记者梁傲男)国产开源大模型的牌桌上,又落下一张新牌。

    过去几个月,Kimi K3、DeepSeek V4 Pro相继发布,Coding、Agent能力成为新一轮竞争焦点。8月14日,智谱交出自己的答卷:新一代基座模型GLM-5.3发布。值得注意的是,这次升级没有换基座,与上一代基座模型相同,能力跃升来自后训练Scaling。对关注成本结构的人来说,这本身就是个信号:不靠堆参数,靠训练方法把智能上界往上推。

    据智谱官方技术报告,在衡量真实终端环境复杂任务的Terminal-Bench3.0上,GLM-5.3得分从上一代的4.6提升至28.3,为开源模型第一;聚焦长程软件工程的DeepSWE v1.1从46.2提升至66.9。编程与智能体能力接近海外最强闭源模型Claude Fable 5。还有一个容易被忽略的数字:在自研的真实编程场景评测中,GLM-5.3以约5万tokens的单任务平均输出,做到了Claude Opus4.8约12万tokens才达到的准确率水平——更短的执行路径,意味着更低的推理成本。

    但这次升级的看点,并不止于编程。随着大模型走向真实软件工程,行业竞争正在从“模型能不能写代码”转向“模型能不能完成复杂任务”,而网络安全正是这条能力曲线上的下一个台阶——它要求模型在读懂代码之外,进一步理解程序逻辑、协议规则、权限边界和攻击路径。对模型厂商而言,这也是一个付费意愿更强的市场:安全历来是企业IT支出中最刚性的预算科目之一。

    评测和实战都给出了佐证。在CyberGym漏洞推理评测中,GLM-5.3以84.5%的成绩超过Mythos 5(83.8%)和GPT-5.6 Sol(83.6%);在更考验深度推理的ExploitBench中取得54.4%,是上一代(24.4%)的两倍多。自上一代模型发布以来,智谱联合清华大学、南开大学及奇安信、腾讯玄武等头部安全团队持续开展红队测试,累计发现潜在漏洞2436个,其中1097个为中高危;研究人员还借助模型发现了一类潜伏40余年的DNS协议级风险——攻击者仅需少量特殊请求,即可将服务器计算压力最高放大近8万倍,潜在影响超过1000万处公网DNS服务。模型能力,正在走出Benchmark、进入真实专业工作流。

    能力的落点,最终指向商业化。对基础模型公司而言,下一阶段的竞争不仅是模型能力之争,更是高价值场景之争——Coding Agent、安全审计、企业服务,都可能成为商业化的重要入口。据了解,智谱已同步上线官方编程工具ZCode、效率工具AutoClaw及GLM Coding Plan订阅服务,模型将接入TraeWork/TraeCode、扣子、WorkBuddy/CodeBuddy、Qoder/QwenWork、CatPaw、JoyCode、OpenCode等平台,API很快上线,完整模型权重计划两周内开源。

    从单项能力比拼,到高价值场景争夺。GLM-5.3的发布,把国产大模型的竞争推进到了一个新阶段。

(编辑 张文玲)

-证券日报网

版权所有《证券日报》社有限责任公司

互联网新闻信息服务许可证 10120240020增值电信业务经营许可证 京B2-20250455

京公网安备 11010602201377号京ICP备19002521号

证券日报网所载文章、数据仅供参考,使用前务请仔细阅读法律申明,风险自负。

证券日报社电话:010-83251700网站电话:010-83251800

网站传真:010-83251801电子邮件:xmtzx@zqrb.net

官方客户端

安卓

IOS

官方微信

扫一扫,加关注

官方微博

扫一扫,加关注