博客

GLM-5.3 开源了,但不是 MIT:和 GLM-5.3-Flash 的许可证差在一条 100 亿美元门槛

GLM-5.3 权重 8 月 28 日落地,许可证是自定义 GLM-5.3 License,不是 GLM-5.3-Flash 的 MIT。逐字对照只差一条:运营模型即服务且 12 个月收入超 100 亿美元者,商用前须过 Z.AI 安全审查。同周 Kimi K3 与 Hy4-preview 各走一路。

Linden Kern约 10 分钟
GLM-5.3 在 OpenRouter 上的 16 个端点矩阵(2026-08-29 05:24 UTC),按自报量化分组:bf16 一家 $1.20/$4.00,fp8 七家输入 $1.25–1.40,fp4 两家 $1.40/$4.40,unknown 六家 $1.40/$4.40

先给结论。GLM-5.3 的权重可以下载、可以商用、可以微调和再分发,但它的许可证不是 MIT。 Hugging Face 模型卡的字段写的是 license: otherlicense_name: glm-5.3, 指向仓库里一份自定义的「GLM-5.3 License」。把它和 GLM-5.3-Flash 的 MIT 逐字对照, 骨架相同,多出来的只有一条:**如果你运营「模型即服务」业务,并且你和关联方在任意连续 12 个月内累计收入超过 100 亿美元,商用前须通过 Z.AI 的安全审查。**对绝大多数人,这份许可证 读起来等同 MIT;对少数几家超大云厂,它多了一道门。

这件事值得单独写一篇,有两个原因。一是 GLM-5.2 和 GLM-5 都是 MIT,GLM-5.3-Flash 也是 MIT, 旗舰这一代是 GLM-5 系列第一次离开 MIT。二是同一周落地的另两份大参数开源权重——Kimi K3 和 腾讯 Hy4-preview——各走了一条不同的路线。把三份文本摆在一起,「开源」这个词在 2026 年 8 月底的实际含义就看清了。

两份许可证并排:GLM-5.3 License 比 MIT 多了什么

先核字段。Hugging Face API 里,zai-org/GLM-5.3cardData{"license": "other", "license_name": "glm-5.3"},最后修改时间 2026-08-28 15:22 UTC;BF16 姊妹仓 zai-org/GLM-5.3-BF16 同一字段、同一许可证。 zai-org/GLM-5.3-FlashcardData.licensemit,仓库里的 LICENSE 是标准 MIT 全文,版权行「Copyright (c) 2026 Z.AI Co., Ltd」, 没有任何附加条件。

Hugging Face 上 zai-org/GLM-5.3 模型卡首屏:标签栏显示 License: glm-5.3 与 fp8,Safetensors 面板显示 753B params、张量类型 BF16 · F8_E4M3 · F32
模型卡的标签栏就能看到 License: glm-5.3,不用点进文件。截图 2026-08-29。来源:Hugging Face — zai-org/GLM-5.3

再读全文。GLM-5.3 License 是英中双语的官方文本, 结构与 MIT 一一对应,多出一条:

段落MIT(GLM-5.3-Flash 采用)GLM-5.3 License
授权范围任何获得副本的个人,使用、复制、修改、合并、发布、分发、再许可、销售任何获得副本的个人或实体;在 MIT 列举之外明确加上「运行、部署、微调或以其他方式修改软件并创建衍生作品」;「软件」定义明确包含模型权重、参数、配置文件、推理和训练代码
条件 1保留版权声明与许可声明同 MIT,另加「被许可方对软件的使用必须符合适用法律法规」
条件 2「模型即服务」+ 100 亿美元 + 安全审查(见下)
免责软件按「现状」提供软件及其任何输出和结果均按「现状」提供
联系方式glmlicense@z.ai

第 2 条是全部差别所在,原文(官方中文版)逐字抄录:

若被许可方或其关联方运营”模型即服务”业务,且被许可方及关联方在任意连续 12 个月内累计 总收入超过 100 亿美元(或等值其他货币),则被许可方在使用软件或其衍生作品进行任何商业 用途之前,须通过 Z.AI 的安全审查。安全审查的范围和方式由 Z.AI 合理确定。

其余几处改动——授权对象加上「实体」、把权重和训练代码写进「软件」定义、把「输出和结果」 写进免责范围——都是把一份为源代码写的许可证改造成为模型写的许可证,方向上是补全而不是收紧。 真正的门只有第 2 条这一道。

漫画:石制门楣上刻着 OPEN SOURCE,门确实敞开着;门内一位门房递出一张拖到地上的长纸,上面唯一看得清的一行是 $10,000,000,000,讲台上的黄铜牌写着 CONDITIONS,门房微笑说「Only one condition.」
门是真开的。条件也真的只有一条。

100 亿美元、「模型即服务」、安全审查:三个词各管什么

这一条有三个关键词,逐个看它管到谁。

「模型即服务」的定义是许可证自己给的,同样逐字:

“模型即服务”指以允许第三方对输入、参数或训练数据行使实质性控制的方式,向第三方提供语言 模型推理或微调服务(如通过 API)。不包括:(a) 模型能力仅嵌入特定功能或框架中的终端用户 产品,或 (b) 单纯转发请求至他人托管的模型。

条款写的是:把模型作为 API 卖给第三方、让对方控制输入和参数,算;把模型能力嵌进自己产品 的某个功能里,不算;只做请求转发、模型跑在别人那里,不算。我们的读法:第一类是推理托管商, 第二类是应用开发者,第三类是网关和路由器——只要不自己托管权重,就在排除项 (b) 里。这是 我们对文本的理解,不是法律意见。

100 亿美元是触发线,按被许可方及其关联方连续 12 个月的累计总收入算,不是按这个模型 带来的收入算。这条线画得很高。同周 Kimi K3 的同类条款画在 2000 万美元(下一节详述), 差了五百倍。用「总收入」而不是「模型相关收入」做口径,意味着一家大型云厂的其他业务收入 也计入——条款针对的对象是谁,读一遍就清楚。

安全审查是触发后的动作。条款说的是「须通过 Z.AI 的安全审查」,而「安全审查的范围和 方式由 Z.AI 合理确定」。也就是说,触发方要做什么、要多久、标准是什么,文本没有写, 留给 Z.AI 决定。这是一条开放条款,和 Kimi K3 的「须另行与 Moonshot AI 签订协议」是 同一类结构:过线之后,从许可证进入谈判。

对二次托管方意味着什么?按文本:收入没到 100 亿美元的托管商,这一条对你不生效,你拿到的 权利和 MIT 一样宽——包括拿它收费卖推理。HN 上有人问「这会不会上 Bedrock」,回答是 「many of them (kimi k3, glm-5.3) have license requirements to sell them with model-as-a-service」(hhh 的评论)—— 这条评论把两份许可证并列,是对的;但两份的门槛差五百倍,「有要求」和「要求管到谁」是两件事。

还有一个值得记录的细节:模型卡正文从头到尾没有提到许可证,只有 frontmatter 里那两个字段。 Z.ai 8 月 14 日的发布文承诺「We will release the weights in two weeks after launch, once safety evaluation and hardening are complete」(GLM-5.3 发布文), 8 月 28 日兑现,整整两周;但从发布文到模型卡,没有一句话解释为什么这一代旗舰离开了 MIT。 条款本身写得清楚,动机没有官方口径,我们也不猜。

同一周三条路线:GLM-5.3、Kimi K3、Hy4-preview

把三份文本放在一张表里。Kimi K3 的许可证全文我们此前已读(Kimi K3 License), Hy4-preview 的模型卡与许可证字段来自 Hugging Face(tencent/Hy4-preview):

GLM-5.3Kimi K3Hy4-previewGLM-5.3-Flash(对照)
许可证GLM-5.3 License(MIT 骨架 + 1 条)Kimi K3 License(MIT 骨架 + 3 条)Apache-2.0MIT
「模型即服务」定义有,与 GLM-5.3 逐字相同
触发门槛12 个月累计收入 > 100 亿美元12 个月累计收入 > 2000 万美元
触发后过 Z.AI 安全审查与 Moonshot AI 另签协议
附加义务月活 > 1 亿或月收入 > 2000 万美元的产品须在界面显著标注「Kimi K3」
豁免无单列内部使用;经官方产品或认证推理伙伴使用
参数(自报)753B 总参数770B 总 / 49B 激活320B 总 / 18B 激活
HF 仓库最后修改2026-08-28 15:22 UTC此前已发布2026-08-28 14:58 UTC2026-08-27

参数一列只写各模型卡自己给的数字,不做横比。

三条路线各自的逻辑,按文本读:Apache-2.0 是传统开源许可证,没有任何针对模型商业化的 条件,Hy4-preview 选它,等于对托管商不设任何门槛;Kimi K3 把门槛放在 2000 万美元, 再加署名义务,覆盖面宽得多——一家中型推理托管商就可能触发;GLM-5.3 把门槛抬到 100 亿美元,只留一道安全审查,覆盖面最窄,但保留了「对特定对象说不」的权利。三家都叫 「开源权重」,托管商拿到的合同并不一样。

顺带核一件事:GLM-5.3 License 第 2 条对「模型即服务」的定义,与 Kimi K3 License 第 2 条 的定义逐字相同,包括 (a)(b) 两项排除。两家用了同一段措辞,只改了门槛数字和触发动作。 这段定义正在变成中国开源模型许可证的一段通用条款——下一份出现时,读者可以直接跳到数字。

哪里能用:权重上线 14 小时后的端点面

许可证决定谁能托管,端点面决定你今天能从哪里调。我们在 en 刊的同题深度篇 里把 OpenRouter 的 endpoints API 快照逐行读了一遍,这里只放结论。

权重最后一次提交是 8 月 28 日 15:22 UTC。8 月 29 日 05:24 UTC, OpenRouter 的 z-ai/glm-5.3 已列 16 个端点: 输入价 5 档($1.20 到 $1.40 / 百万 token),输出价 3 档($3.96 到 $4.40); 12 家按 Z.ai 官方列表价 $1.4 / $4.4 收费(Z.ai 价目页, 与 GLM-5.2 同价);自报量化 bf16 一家、fp8 七家、fp4 两家、unknown 六家;上下文 262,144 两家、1,048,576 十三家、1,310,720 一家。**最便宜的一条(DeepInfra,$1.20 / $4.00) 自报 bf16,两条 fp4 卖的是列表价。**量化字段全部是端点自报,OpenRouter 原样透传, 我们没有验证过任何一家实际服务的精度。

想自己部署的读者看仓库:主仓是 FP8 权重——Hugging Face 元数据里 753,329,940,480 个参数中 751,226,191,872 个是 F8_E4M3——141 个 safetensors 分片合计 755.6 GB;BF16 姊妹仓 参数量相同,按每参数 2 字节估约 1.5 TB(我们的换算)。这一代 Z.ai 把 FP8 作为默认发布件、 BF16 作为附属仓,HN 评论者指出这和上一代的做法正好相反。

Benchmark 一段按自报读。模型卡给的数字:Terminal Bench 3.0 从 GLM-5.2 的 4.6 到 28.3, DeepSWE v1.1 从 46.2 到 66.9,Agents’ Last Exam 从 23.8 到 28.5;自称「the most capable open-weights model for coding」。表里其他厂商模型的分数也是 Z.ai 自己跑的,纵向看代际进步 可以,横向拿去和别家官网的数字打架不行——我们在 ox-alpha 那篇 说过同一句话,这次同样适用。

Z.ai 官方 benchmark 图:GLM-5.3 与 GLM-5.2、Kimi K3 及两个闭源模型在六项评测上的对比柱状图
模型卡与发布文共用的官方 benchmark 图,六项评测,全部为 Z.ai 自报。来源:Z.ai — GLM-5.3 发布文

下次再看一份「开源」许可证,先找这三行

这周三份文本读完,可以把方法收成一张三步的清单,下一份权重落地时直接用:

  1. **看模型卡 frontmatter 的 license 字段。**写 mitapache-2.0 的,到此为止; 写 other 的,license_name 告诉你文件叫什么,点进去读全文。GLM-5.3 在这一步就 和 Flash 分开了。
  2. **找「模型即服务」(Model as a Service)的定义。**有这段定义,说明许可证在区分 「托管卖推理」和「嵌进产品」——你先判断自己在哪一类,排除项 (a)(b) 通常写得很具体。
  3. **找门槛数字和触发后的动作。**门槛是 100 亿还是 2000 万,触发后是「过审查」「另签 协议」还是「界面署名」,这三个数字和动词决定了这份许可证对你的实际含义。

我们在调价通知那篇说过,价格表多久复核一次 取决于条款给的通知期。许可证是同一类东西:它是一份合同文本,不是一个标签。「开源」在 Hugging Face 的过滤器里是一个勾选框,在 LICENSE 文件里是三到五条各不相同的条件。 GLM-5.3 这一份,对绝大多数读者来说,读完可以放心;但「读完」这个动作,省不掉。