Z.ai 发布可识图的 GLM-5.3-Flash,价格约为 GLM-5.2 的十分之一
新开源模型采用 MoE 架构,支持图像和视频,并配备 100 万 token 上下文窗口
📅 2026年8月28日 00:04
Zhipu AI 的国际品牌 Z.ai 于 2026 年 8 月 26 日正式发布 GLM-5.3-Flash,将其定位为性能更高、使用成本较 GLM-5.2 降低约 10 倍的中型模型。
该模型采用 Mixture-of-Experts(MoE,按任务仅调用模型部分组件的机制)架构,总参数量为 320B,每个 token 实际激活 18B 参数,从而降低计算资源消耗。官方公布的基准测试显示,GLM-5.3-Flash 在多个项目中的整体表现优于 GLM-5.2。
一项重要升级是 Multimodal(多模态)能力,使模型无需依赖独立模型即可读取图像和视频。除常规对话和编程任务外,这项能力也适合分析屏幕、图像文档及网站视觉元素。
GLM-5.3-Flash 还配备 100 万 token 的 Context Window(模型单次任务可处理的信息量),可一次处理大量文档或代码。不过,支持更长上下文并不意味着模型能同等准确地记忆和使用其中所有细节。
正式发布前,该模型曾以未公开开发者身份的 Ox Alpha 名称,通过 OpenRouter 和 OpenCode 提供测试。此外,它从一开始便针对中国国产 AI 芯片进行适配,反映出降低对海外硬件依赖的努力。
Z.ai 以 MIT 许可证发布该模型的 Open Weights(开放权重),开发者和机构可依照许可证条款进行研究、微调或自行部署。
Why it matters
价格降低约 10 倍并开放权重,可为需要图像理解或长文本处理能力的泰国开发者提供更多选择,不必只依赖闭源模型服务。但在实际采用前,仍应针对泰语及具体应用测试其准确性。
价格降低约 10 倍并开放权重,可为需要图像理解或长文本处理能力的泰国开发者提供更多选择,不必只依赖闭源模型服务。但在实际采用前,仍应针对泰语及具体应用测试其准确性。
Sources (rewritten & summarized from): Blognone · z.ai · openrouter.ai · marktechpost.com · businessinsider.com · scmp.com