产品
模型家族
Next Token / Wiki

GLM

智谱的通用语言与多模态模型家族,为对话、推理、代码、工具调用和 Agent 等任务提供基础能力。

别名

General Language Model · GLM-5.3 Flash · GLM 5.3 Flash · 牛来

GLM 模型家族是什么

GLM 是智谱的通用模型家族,覆盖语言、视觉理解与生成等模态,既支撑智谱自己的产品,也通过 API 和开放权重对外提供。围绕这一条模型主线,智谱的产品分层是:面向终端用户的对话助手(智谱清言,国际入口 z.ai);面向开发者的模型 API(国内为 BigModel 开放平台,国际为 docs.z.ai 文档对应的 API);以及建立在这些模型之上的 Agent 产品,如编码开发环境 ZCode 和面向设备操作的 AutoGLM。公司背景与产品线总览见智谱品牌条目,本条目聚焦模型家族与开发者接口本身。

家族以 GLM-5 系列为现行主线:官方发布记录显示,GLM-5 于 2026 年 2 月发布,GLM-5.2 于 2026 年 6 月发布;GLM-5.3 于 2026 年 8 月 18 日发布,官方将其定位为面向复杂软件工程与 Agent 能力的旗舰模型;GLM-5.3-Flash 于 2026 年 8 月 26 日发布,是 GLM-5 系列首个原生多模态模型。除语言模型外,API 还提供视觉理解(GLM-4.6V、GLM-OCR 等)、图像生成与语音识别等模型,模型与价格会变化,使用前应以官方文档为准。

用途与使用边界

开发者通过 API 调用时使用小写模型 ID:旗舰 glm-5.3 为纯文本输入,标注 1M Token 上下文窗口、始终开启推理并支持 low/high/max 三档推理力度;glm-5.3-flash 与更快的 glm-5.3-flashx 接受视频、图像、文本和文件输入,官方标注 320B 总参数、18B 激活,采用稀疏注意力与线性注意力混合架构。这些规格以官方模型文档当前标注为准,不能从模型名称推断。

开放权重一侧,GLM 系列模型发布在 Hugging Face 的 zai-org 组织下,其中 GLM-5.3-Flash 按官方博客说明以 MIT 许可发布。自托管时需要自行核对模型卡中的许可、硬件要求与推理框架支持。

面向编码场景,智谱提供按月订阅的 GLM Coding Plan,订阅后可在 ZCode、Claude Code、Cline、OpenCode 等工具中调用 GLM-5.3 与 GLM-5.3-Flash,订阅与按量 API 计费是两种不同的付费方式。ZCode 的安装与使用见 ZCode 条目;与 Qwen、DeepSeek 等其他国产模型家族的比较见各自条目。

节目中的讨论

Weekly #001 的模型盘点中,杨攀把“过去一周非常火的智谱 GLM 5.3 Flash,也就是大家知道的’牛来’模型”列入发布列表,并提到智谱 5.3 随后开源(开源部分)。在“GLM 5.3 Flash 与 MiniMax H3,便宜模型为何更容易进入真实使用”一章中,歸藏认为能力够用、成本低的模型更容易进入真实使用,“很多东西大家用不起,就不关注”;杨攀补充自己在电脑上试过 5.3 Flash,属于 256G 内存本机可运行的模型。

同一期“Computer Use 正在怎样改变 Vibe Coding 的验收”一章中,杨攀把“牛来”与 Gemini 归纳为两条路线:Gemini 拉速度,智谱走普惠、把供应量放开;橘子将其归因于全新架构、原生多模态、“又小又强”;向阳乔木提到它在 OpenRouter 开放较久、支撑全球使用量,一度被网友推测不是中国模型。在“当所有模型都差不多,用户该如何选择”一章中,歸藏认为 GLM 5.3 免费让大家试是很不错的选择,因为试模型本身有成本。

关于与上层工具的配合,歸藏在“原生模型加原生 Agent”一章中提到在 ZCode 里用“牛来”做多模态任务时 Token 消耗较高、额度不够用。在“Token Is New Money”前后的讨论中,杨攀称“牛来”这么便宜,也比 Claude 3.5 强多了;歸藏则指出 GLM 5.3 Flash 的供应其实不够,想打折也打不动。

Weekly #002 中,“能力够用之后,测试与交付成为瓶颈”一章讨论了新模型是否取代“牛来”成为新的斩杀线,杨攀认为“牛来”速度仍偏慢(补充)。在“Mistral、Kimi 与模型产品的不同选择”一章中,橘子转述唐杰关于 GLM 6 的说法,认为“下一段 GLM 6 应该到了”——这是对未发布产品的期待,不构成已发布功能的陈述。可分别阅读第 001 期 GLM 5.3 Flash 章节与第 002 期对应章节。

常见问题

GLM 是什么模型,是谁开发的?

GLM 是智谱(Z.ai)开发的通用大模型家族,覆盖语言、多模态理解与生成等任务;公司背景见智谱品牌条目。搜索“GLM”时也会命中女演员桂纶镁和图形学中的 OpenGL Mathematics 库,属于同名歧义。

GLM 官网在哪里,怎么免费试用?

终端用户可使用国际入口 z.ai 或国内对话产品智谱清言;部分模型提供免费档位(如 GLM-4.7-Flash)。当前可用的模型与免费方式以官方文档和价格页为准。

GLM API Key 在哪里申请?

国内在 BigModel 开放平台注册并创建 API Key,国际走 Z.AI API 文档的入门流程,然后按文档填入模型 ID(如 glm-5.3)调用。不要把密钥放进公开网页或公开代码仓库。

现在 GLM 最新的模型是哪个?

截至 2026 年 9 月,官方文档列出的旗舰模型为 GLM-5.3(模型 ID glm-5.3),并提供 GLM-5.3-Flash 与 GLM-5.3-FlashX。家族滚动更新,最新型号请以官方发布记录和价格页当前列表为准。

GLM Coding Plan 是什么,和 API 按量计费有什么区别?

GLM Coding Plan 是面向编码场景的按月订阅,在 ZCode、Claude Code、Cline、OpenCode 等工具中调用 GLM-5.3 与 GLM-5.3-Flash;API 按量计费则按 Token 用量扣费,适合自己写程序调用。订阅档位与额度见官方 Devpack 文档,费率以官方页面为准。

GLM 的开源权重在哪里下载?

在 Hugging Face 的 zai-org 组织页面下载。GLM-5.3-Flash 按官方博客说明采用 MIT 许可;下载自托管前应核对具体模型卡的许可与硬件要求。

来源

基本信息

类型
模型家族
所属品牌
智谱 →