简介
智谱(Z.ai)在 2026 年完成 GLM-5 到 GLM-5.3 的四代迭代,8 月开源的 GLM-5.3-Flash 为 320B 总参数、A18B 激活的原生多模态模型,
2026 年 8 月,智谱(Z.ai)把 GLM-5.3-Flash 的权重完整开放,这是一款 320B 总参数、A18B 激活的原生多模态模型,在 Artificial Analysis 的 AA 指数上拿到 57 分,与 Claude Opus 4.8 持平,而定价仅为其四十分之一。从 2 月的 GLM-5 到 8 月的 GLM-5.3,智谱在半年内完成四代迭代,这种节奏在开源阵营里极为罕见。
一、事件速览
智谱 2026 年的产品节奏可以用季度制来形容:2 月发布 GLM-5,一个约 7440 亿参数的开源 MoE 模型;4 月迭代到 GLM-5.1;6 月推出 GLM-5.2;8 月开源 GLM-5.3-Flash。每一代都在参数效率与多模态能力上做加法,而 5.3-Flash 是关键转折,它把原生多模态与 Flash 级推理成本结合在一起,320B 总参数只需激活 18B 即可运行。智谱源自清华大学,是 AI 六小虎中第一家完成上市的公司,充足的资本使其有能力维持这种高频迭代。从 GLM-5 的 7440 亿参数到 GLM-5.3-Flash 的 320B,模型总规模看似缩小,实际反映的是稀疏化程度与训练效率的提升,即用更少的参数换取更可用的效果。
二、关键数据与技术细节
- 模型规格:GLM-5.3-Flash 为 320B 总参数、A18B 激活的 MoE 架构,单次推理只需调动极小比例参数。
- 能力定位:原生多模态,文本与图像等输入在同一模型内完成融合,而不是外挂视觉编码器。
- 评测成绩:Artificial Analysis AA 指数 57 分,与 Claude Opus 4.8 持平。
- 价格水平:约为 Claude Opus 4.8 的四十分之一,接近用四十分之一成本换取同档智能。
- 代际节奏:2026 年 2 月 GLM-5、4 月 GLM-5.1、6 月 GLM-5.2、8 月 GLM-5.3-Flash,半年四代。
- 团队出身:源自清华大学,是 AI 六小虎中首家上市公司。
三、行业影响与解读
GLM-5.3-Flash 的真正杀伤力,在于把前沿智能的价格带拉低了一个数量级。当一款模型在综合指数上追平顶级闭源旗舰,而价格只有其四十分之一时,中小团队原本无法承担的智能体、长文档处理与多模态应用突然变得可以算账。对智谱自身而言,开源是对抗字节、阿里等大厂流量优势最有效的手段,用开放权重换取开发者心智,再靠 API 与企业部署变现。对整个行业来说,这种打法正在持续压缩闭源旗舰的溢价空间,2026 年下半年模型定价的下行压力,很大程度上就来自这类开源 Flash 型号。另一个不能忽视的背景是,智谱几乎每个季度都有新版本,这种稳定性本身就是一种产品承诺,企业客户在选型时会把它视为长期可依赖的信号。
四、值得关注的信号
- 半年四代的迭代速度说明智谱把模型发布当成了产品运营,稳定性与文档质量将决定开发者是否真的留下。
- AA 指数 57 分与 Claude Opus 4.8 持平,意味着开源与闭源在综合体验上的差距正在快速收敛。
- 320B 总参数、18B 激活的组合显示 MoE 稀疏化已成为中国厂商的通用解法,推理成本仍是主战场。
- 作为六小虎中首家上市公司,智谱的研发投入节奏与股价表现会互相影响,值得持续跟踪。
小结:从 GLM-5 到 GLM-5.3-Flash,智谱用半年时间证明了高频迭代加开放权重是一条可复制的路径。AA 指数 57 分与四十分之一的定价,让它在 2026 年的开源竞争中占据了极具说服力的位置。接下来要看的,是这种速度能否在商业化压力下继续保持。
