智谱发布GLM-5.3:7430亿参数,编程能力提升50%,开源模型第一

Published on: 2026-08-15

8月14日,智谱把GLM-5.3甩了出来,标题直接喊"编程能力最强的开源模型"。总参数7430亿,编程能力比上一代GLM-5.2提升50%。对我们这种一直用铠盒AIBOX本地AI盒子的人来说,这条消息比那些跑分榜有意思——因为模型越强、开源的越多,最后真正受益的,恰恰是手里有自己算力、不被单一厂商绑死的人。

先把背景摆清楚。GLM-5.3是继Kimi K3、DeepSeek V4 Pro之后,国产大模型在同一个月里交出的又一份答卷。一个月里三家国产厂商轮番发旗舰,这在两年前是不敢想的。智谱这次没换底座,却把编程能力硬生生抬了50%,这个打法本身就值得拆。

先说它有多能打。GLM-5.3的基座模型跟GLM-5.2一模一样,没换,全靠"极致的后训练Scaling"把上限抬了一大截。换句话说,这不是堆参数堆出来的,是训练方式上的突破。核心成绩摆在这:编程能力较前代提升50%,Terminal-Bench 3.0得分28.3拿下开源最佳、超过Kimi K3,DeepSWE 1.1得分66.9,在多项主流基准测试里都是当前排名最高的开源模型,编程和智能体能力已经逼近Claude Fable 5。

编程体感这块有个细节挺能说明问题。在真实编程场景的Z.ai Code Bench评测里,GLM-5.3在High思考档位下准确率达到31.4%,超过了Claude Opus 4.8最高档位的29.5%。更关键的是token利用率——它每项任务平均输出约5万tokens就完成任务,而Opus 4.8要花约12万tokens。用更短的执行路径完成了更准的活,这意味着同样一个任务,它烧的算力更少、花的钱更少、跑得还更快。

更让人意外的是它顺手把网络安全这块也补强了。白盒代码审查、漏洞挖掘这些安全任务上,GLM-5.3的表现对标Mythos 5,CyberGym漏洞验证得分84.5%,比上一代77.2%高出一截,也略高于Mythos 5的83.8%。有评测说它能一口气挖出两千多个漏洞,中高危占一半。这个方向对做私有化、做安全防御的人来说,意义可能比写代码还大——毕竟会写代码的模型一抓一大把,能主动帮你找漏洞、堵漏洞的,才是真稀缺。

配图

这里面最值得拆的,其实是"基座没变、全靠后训练"这件事。过去大家默认模型要变强就得堆更大的参数、喂更多的数据,预训练成本是天文数字,只有巨头玩得起。GLM-5.3走的是另一条路:底座不动,用数十倍的长程任务环境、更丰富的环境类型、超长的后训练时间,把同一个底座的智能上界挖出来。官方自己都说,这个底座还有不小的性能挖掘空间。

这意味着大模型的"军备竞赛"正在从拼钱拼算力的预训练,转向拼方法拼耐心的后训练。门槛在往下走,玩法在变。以前一个旗舰模型的诞生意味着几百上千张卡烧几个月,现在同一个底座反复调优也能出旗舰级表现。对开源社区、对想自己部署模型的中小团队,这是实打实的利好——不用砸天价算力,也能摸到前沿模型的能力。

智谱说完整权重两周内开源。一个7430亿参数、编程逼近Fable 5的模型,普通人很快就能免费拿到手、本地部署。这跟上一代GLM-5.2的节奏一致——当时GLM-5.2就是MIT协议全量开源,API同步上线BigModel和Z.ai,还Day 0适配了华为昇腾、摩尔线程、寒武纪这些国产算力平台。到了5.3,模型更强了,开源的承诺没缩水。

上线渠道也已经铺开。GLM-5.3即日起上线智谱官方的ZCode编程工具、AutoClaw效率工具,GLM Coding Plan全量用户直接用。金山办公的灵犀专业版也首发接入了,用户在灵犀里切个模型就能用上。京东云MaaS平台也同步完成了适配上线。这个铺开速度,说明智谱是真想让它快速跑起来,不是发个论文就完事。

配图

把这件事放回当天的语境看更有意思。同一天,谷歌发了Gemini 3.7 Flash,DeepSeek发了Harness,英伟达发了Nemotron。开源、编程、Agent这三件事在同一天里反复出现。趋势已经不需要争了:模型在开源化,能力在Agent化,价格在白菜化。

但对普通人来说,真正的难题从来不是"找不到好模型"。模型这么多、还一个比一个强,GLM-5.3出来你切过去,下个月Kimi再发个更强的你是不是又得切回来?数据、工作流、习惯全被打散在各家的API里。今天用智谱的接口存一份,明天用Kimi的接口存一份,后天DeepSeek又涨个价逼你搬家。这才是真正卡住人的地方。

这里就回到铠盒AIBOX的价值。它不是一个"跑某个模型"的盒子,是本地跑Agent编排的中枢——把GLM、Kimi、DeepSeek这些模型当成可调度的资源,哪个便宜用哪个、哪个擅长用哪个,工作流存在本地、数据不出家门。新模型越强,铠盒越强,因为换模型就像换电池,你的数据和流程一根都不动。

这个逻辑放到GLM-5.3身上尤其成立。今天它是开源编程第一,两周后权重开源,本地部署的门槛又降一档。手里有铠盒AIBOX这种本地AI盒子的人,到时候直接把新模型挂上去就行,不用等厂商开接口、不用迁数据、不用重新配工作流。想进一步了解铠盒AIBOX这种本地AI盒子,可以看为什么AI盒子比装电脑里强,或者直接去产品页看看,想对比价格就上官网商城

智谱这次还有句话挺戳人:"当最强的矛被锁在少数人手里,最好的盾必须属于所有人。"开源模型跑得再快,数据放谁手里这个选择,始终在你自己手上。云端有云端的灵活,本地有本地的踏实,怎么选,看你把什么看得更重。

延伸阅读

📖 名词释义

AI Box(又称 AI盒子 / 智能体计算机 / Agent Computer),是一种专门运行 AI Agent 的本地硬件设备,预装智能体应用管理系统,开箱即用,7×24 小时在线运行。用户可以通过微信、飞书、企业微信、钉钉等社交软件远程指挥 AI 帮你干活。

智谱 #GLM-5.3 #开源模型 #AI编程 #本地AI #铠盒AIBOX

了解更多 请搜索【铠盒AIBOX】

欢迎联系邮箱:[email protected]

—— 铠盒AIBOX · 7×24小时为你工作的私人AI助手 | AI前沿

推荐产品

铠盒 A1 家用入门款 铠盒 A1 Pro 增强款 铠盒 A2 专业款 铠盒 A2 Pro 进阶款 铠盒 X1 企业款 铠盒 G1 旗舰款
© KAIHE AI - Agent Computer Specialist