智谱|GLM-5.3 API开放;Artificial Analysis开源权重情报指数约60分并列领先

PromptTree|阅读 0
2026/08/20 09:40
智谱GLM-5.3Artificial Analysis开源权重
智谱(Z.ai)将GLM-5.3以与5.2相同的API标价开放调用;Artificial Analysis Intelligence Index约60分,与Kimi K3并列开源权重前列;权重仍待安全评估后开源。

同一套基座能不能只靠后训练再跳一截?智谱把GLM-5.3写成这场「控制变量」实验的产品化结果:先把能力抬上去,再把API价格钉在与前代相同的价位上,让开发者用账单而不是海报做对比。

智谱AI(对外品牌Z.ai)是国内大模型厂商,GLM系列覆盖对话、编码与Agent相关能力。公开材料称,GLM-5.3与GLM-5.2共用基座与架构,增量主要来自长时域环境与强化学习后训练——也就是说,这次公开叙事刻意不把「换更大基座」当作主角。所谓后训练,白话是基座预训练之后,再用强化学习、偏好优化与真实环境交互把模型「练熟」到特定任务;所谓开源权重情报指数,白话是第三方把多家模型放进同一套综合评测里打的相对分,方便横向对照,但不是生产一次通过的保证书。

随后,GLM-5.3以API形式开放调用,标价与5.2对齐:输入约1.40美元/百万token、输出约4.40美元/百万token,缓存输入约0.26美元/百万token。第三方评测机构Artificial Analysis给出Intelligence Index约60分,公开报道称与Moonshot的Kimi K3并列开源权重前列,相对GLM-5.2约提升7分。同一评测亦提醒:5.3更「健谈」,完成同等任务的输出token更多,因此单位任务成本约0.68美元,高于5.2的约0.44美元——标价相同不等于账单相同。

可以把本轮验收标准改写成三句话:

  1. 能力层:后训练把编码与Agent相关指标抬升,第三方综合指数进入开源权重第一梯队叙事。
  2. 价格层:按token标价与前代持平,但更长输出会抬高真实任务成本,采购要看「单位成功工作流」而非单价海报。
  3. 开放层:权重仍待完成安全评估与加固后再放开下载,时间窗口约两周量级;在此之前主要走API与编码工具链。

智谱创始人唐杰亦在公开讨论中强调:参数量不是唯一旋钮,数据、算力分配与后训练同样关键,并把5.3定位为有意保持基座不变、优先拨动后训练的一次实验。对产业观察者,这条的价值是把「Scaling Law只剩堆参数」的单一叙事拆开:在固定基座上加长时域RL,也可能换来可感知的能力跳变。合规边界上,部分讨论涉及其安全相关能力的细节,本条不展开攻击链与受害面,只记录「API可用 + 第三方综合指数 + 权重延期开源」这一可核验事实。

需要把边界读清楚。榜单与厂商自报不等于生产一次通过;权重未放开前,采购仍受API与合规条款约束。下一观察点是权重实际开源日与许可条款,以及「更强但更冗长」在真实Agent账单上的净效应——能上榜是信号,能把单位成功工作流成本压住才是验收。