智谱 AI / Z.AI · 推理模型

智谱 GLM 系列

GLM-5.3 与 GLM-5.3-Flash 覆盖长程 Agent、代码、工具调用和原生多模态,并提供 API 与开放权重路径。

查看官方模型文档 官方资料核验于 2026/08/27

资料待复核:以下为 2026/08/27 的研究快照,型号、价格与可用性可能已变化。请通过上方官方文档确认最新信息。

当前主线GLM-5.3-Flash
上下文GLM-5.3-Flash 最高 1M;其他型号按官方模型页核验
输入模态文本、图像、视频与文件(按型号)
交付形态Z.AI API、智谱开放平台、开放权重(按型号)、私有化与企业服务
Current Models

当前重点型号

GLM-5.3GLM-5.3-FlashGLM-5.2GLM-5.1GLM-5V-Turbo

价格与采购观察

每百万 Token:GLM-5.1 输入 1.4 美元、缓存 0.26 美元、输出 4.4 美元;GLM-5 为 1 / 0.2 / 3.2 美元。人民币区与套餐以对应平台为准。

进入全量模型端点与价格目录

当前主线

GLM-5.3 面向复杂编码与长程任务;8 月 26 日开放的 GLM-5.3-Flash 以 320B 总参数、18B 激活参数和混合稀疏/线性注意力降低推理计算,最高支持 1M 上下文,并成为 GLM-5 首个原生多模态型号。Flash 仍是服务器级权重,不能按 18B 激活参数估算完整内存。

Agent 与企业评估

评测重点包括大型代码库修改、工具调用、长任务规划、结构化输出、中文业务和视觉界面理解。企业可把 5.3 用于高难任务,以 Flash 或较低档位承接高频流程,并通过统一路由做回退。

风险与边界

型号迭代快,开放权重、国内平台与国际 Z.AI API 的可用版本和价格可能不同。长任务宣传必须在真实工具链、权限和中断恢复条件下验证,不能只引用榜单或演示。

Continue Research

继续完成企业模型决策