智谱Coding Plan回归:积分制接管用量

智谱重新开放 GLM Coding Plan 订阅,月费 118 元起。新版将模型 Token 与 MCP 调用统一折算为积分,并公开峰谷倍率、刷新周期和抵扣系数。
智谱 Coding Plan 回归:积分制接管模型与 MCP 用量
智谱在今天(2026 年 7 月 31 日)重新开放 GLM Coding Plan 订阅,月费 118 元起,并将模型 Token、缓存命中和 MCP 工具调用全部纳入一套公开积分体系。即日起至 8 月 15 日,新版包年套餐限时 7 折,包季套餐限时 8 折;已有套餐用户的价格、权益、额度与计算方式不受此次调整影响。
这次回归真正值得关注的并不是折扣,而是智谱终于把“一个订阅究竟能用多少”变成了一道可以复算的数学题。经历年初升级争议、老套餐停止自动续订以及 GLM-5 灰度节奏问题后,透明度已经不是锦上添花,而是 GLM Coding Plan 能否重新建立开发者信任的前提。

GLM Coding Plan 是什么
GLM Coding Plan 是智谱面向 AI 编码场景提供的订阅套餐,主要用于自然语言编程、代码生成、代码调试与修复、代码库问答以及自动化任务处理。它并不是一个面向任意应用的通用模型套餐,而是限定在官方支持的 Coding 工具和产品环境中使用。
这个边界对开发者很重要:在 Claude Code、Kilo Code、OpenClaw、OpenCode、TRAE、CodeBuddy 等受支持工具中产生的模型请求,可以消耗 Coding Plan 额度;如果把模型接入自建网站、机器人、SaaS 产品或其他应用,则需要使用智谱标准 API,并按照另一套规则独立计费。
新版 GLM Coding Plan 的核心变化是积分制。积分制是把不同模型的输入 Token、缓存命中 Token、输出 Token以及 MCP 调用,按照公开系数换算成统一额度的计量方式。
这套设计解决了传统“每几小时最多多少次对话”的模糊性,因为一次 Prompt 并不等于一次模型请求。根据智谱官方说明,一次 Prompt 在智能体执行过程中可能触发约 15—20 次模型调用;代码库越大、工具链越复杂、自动执行步骤越多,同一句指令背后的实际消耗就越高。
118 元起,但不能只看月费
新版套餐目前仍分为 Lite、Pro 和 Max 三档,其中公开信息明确显示订阅价格从每月 118 元起。智谱在本次公告中没有完整披露所有档位的最新月付价格,因此在比较套餐时,更有价值的指标是每 5 小时积分、每周积分以及折算后的 Token 区间,而不是用未经确认的价格拼出一张看似完整的价目表。
以下额度均以全部使用 GLM-5.2、编程场景缓存命中率达到 90.9% 为估算前提。最低 Token 数按全部请求发生在高峰时段计算,最高 Token 数则按全部请求发生在非高峰时段计算。
| 套餐 | 月费信息 | 每 5 小时 Prompt 参考值 | 每周 Prompt 参考值 | GLM-5.2 每周 Token 参考区间 | 适合场景 | | --- | ---: | ---: | ---: | ---: | --- | | Lite | 118 元/月起 | 最多约 80 次 | 最多约 400 次 | 0.43 亿—0.87 亿 | 个人项目、代码补全、轻量调试 | | Pro | 最新完整价格待官方套餐页确认 | 最多约 400 次 | 最多约 2000 次 | 2.63 亿—5.26 亿 | 高频开发、中大型代码库问答 | | Max | 最新完整价格待官方套餐页确认 | 最多约 1600 次 | 最多约 8000 次 | 6.13 亿—12.26 亿 | 多项目并行、长链路智能体任务 |
这些 Prompt 数只是便于理解的估算值,而不是固定可兑现的对话次数。用户让智能体修改一个文件和让它检索仓库、读取网页、分析截图、运行测试再修复错误,虽然界面上都可能只发送一次 Prompt,背后消耗的模型调用和 MCP 次数却完全不同。
智谱给出的最高成本优势是:在充分利用非高峰折扣时,相较按量调用 GLM-5.2 标准 API,成本最多可节省 92%。这个数字代表理想上限,并不意味着所有用户都能稳定获得 92% 的折扣;模型选择、输出长度、缓存命中率和使用时间都会改变实际结果。
模型 Token 与 MCP 被放进同一本账
MCP 是 Model Context Protocol 的缩写,它是一套让 AI 模型连接搜索、网页、代码仓库和其他外部工具的标准协议。在 AI 编码过程中,MCP 的作用类似于给模型增加浏览器、资料库和视觉输入,但每次调用都会占用计算或检索资源。
新版最实用的变化,是模型推理和 MCP 调用不再分别藏在不同的次数说明里。用户可以在费用明细中查看不同模型消耗的 Token 数、缓存命中 Token 数和工具调用次数,再按照公开系数核对积分。
模型积分的计算方式为:输入 Token 乘以输入系数,加上缓存命中 Token 乘以缓存系数,再加上输出 Token 乘以输出系数,最后除以 10000。MCP 积分则按调用次数乘以对应系数计算。
| 产品类型 | 产品名称 | 输入系数 | 缓存命中系数 | 输出或单次调用系数 | | --- | --- | ---: | ---: | ---: | | 模型 | GLM-5.2 | 6.9 | 1.7 | 24 | | 模型 | GLM-5-Turbo | 5.7 | 1.5 | 21 | | 模型 | GLM-4.7 | 4.6 | 1.2 | 16 | | 视觉能力 | GLM-4.6V 视觉理解 MCP | 1.2 | 0.3 | 2.7 | | MCP 工具 | 联网搜索 | — | — | 1.2/次 | | MCP 工具 | 网页读取 | — | — | 1.2/次 | | MCP 工具 | 开源仓库 | — | — | 1.2/次 |
这张表也明确传递了一个信号:模型越强、生成内容越多,积分消耗越快。以 GLM-5.2 为例,输出系数为 24,明显高于 6.9 的普通输入系数和 1.7 的缓存命中系数,因此长篇输出比复用已有上下文更昂贵。
缓存命中 Token 是系统重复使用已经处理过的上下文时产生的 Token,它不需要像新输入一样重新完成全部计算。对代码仓库场景而言,系统提示词、项目规则和大量未变化的源文件都可能被缓存,因此智谱使用 90.9% 的平均缓存命中率估算套餐容量并非没有依据。
透明积分制也让模型选择有了直接成本差异。GLM-5.2 的输出系数为 24,GLM-5-Turbo 为 21,GLM-4.7 为 16;如果任务只是生成测试样例、解释报错或修改少量样板代码,使用较轻模型可能比全程调用最强模型更耐用。反过来,复杂重构和长链路工具调用如果为了节省积分频繁降级模型,也可能因为返工次数增加而得不偿失。
低峰五折,周末全天按低峰计算
非高峰倍率是新版套餐中最直接的价格杠杆,它会把模型调用的基础积分消耗降至 50%。智谱将每周一至周五 14:00—18:00(UTC+8)定义为高峰时段,除此之外均按非高峰倍率计算;无论新老用户,周末全天也按照非高峰倍率抵扣。
这一规则相当于把云计算常见的峰谷定价搬进 AI 编码订阅。个人开发者如果习惯在晚上或周末集中使用智能体,理论可用 Token 数接近表格区间上限;工作日午后高频运行自动化任务的团队,则更接近下限。
峰谷倍率公开后,开发者可以主动安排高消耗任务。例如代码解释和少量补全可以在工作时段完成,而全仓库索引、批量生成测试、跨模块重构与长时间智能体任务可以留到晚间或周末执行。相比简单宣传“高额用量”,这种可调度的成本结构更符合专业用户的使用方式。
额度不再只是“每 5 小时恢复”
动态刷新机制是指每笔请求消耗的 5 小时额度,会在该请求发生 5 小时后释放,而不是所有用户在固定整点一次性重置。新版同时设置每 5 小时额度和每周额度,两道限制需要同时满足。
周积分从套餐下单时开始,以 7 天为一个周期刷新。这样的设计可以避免用户在短时间内集中跑满整周算力,也便于智谱控制高峰并发,但它意味着“等待 5 小时恢复”并不一定能继续使用:如果周积分已经耗尽,用户仍需等待新的 7 天周期。
额度耗尽后的处理方式相对克制。智谱官方 FAQ 显示,Coding Plan 用完后不会继续扣除用户的其他资源包或账户余额,系统会停止消耗,用户需要等待对应周期恢复。这一点比默认产生超额账单更安全,尤其适合让编码智能体长时间自动执行任务的用户。
所有受支持的 Coding 工具会共享同一订阅额度,因此把 Claude Code、TRAE 和 OpenCode 同时接入并不会获得三份独立配额。套餐也不能多人共享;团队如果通过共用账号并发使用,可能被视为不当使用,并面临订阅权益受限。
老用户权益不变,但 v1 仍需等待迁移入口
现有套餐用户是本次调整中最敏感的一群人,而智谱给出的原则是“不追溯修改”。持有当前套餐的个人和团队用户,其价格、额度、权益和计算方式不受影响,仍可按照原套餐继续使用、续订或升档。
v1 无周限流套餐用户的情况更特殊。智谱已在今年 2 月下架最早一代套餐,因此这部分用户目前无法直接续订或升级原产品;其有效期内权益保持不变,并可在到期前按照本次调整前的 v2 价格购买并长期使用,对应功能计划在两周内上线。
这实际上是一种保留价格资格、但不恢复原有无周限流产品的折中方案。它没有让已经下架的老套餐重新上架,却给早期用户提供了进入 v2 的固定通道,避免用户因系统迁移被迫直接接受新版价格。
智谱今年 2 月曾就 GLM Coding Plan 升级问题致歉,并承认规则透明度不足、GLM-5 灰度节奏太慢以及老用户升级机制设计粗糙。随后在 4 月,老套餐中的无周限额版本停止自动续订;今天重新开放订阅,显然是在补齐此前最欠缺的用量解释和老用户安排。
高速版开始开放申请
高速版是智谱面向 Coding Plan 用户提供的更高生成速度体验,目前已经开放申请,老套餐用户优先获得资格。智谱此次没有在公告中承诺所有申请者的固定生成速度、延迟指标或正式开放日期,因此它暂时更接近灰度体验,而不是可以写入采购评估的稳定服务等级。
生成速度对 AI 编码产品的重要性不亚于模型跑分。智能体一次任务可能连续发起十几次模型调用,如果每一步只慢两三秒,完整任务就可能多等待半分钟甚至更久;但在智谱公布明确的 Tokens/s、首 Token 延迟和高峰保障数据前,不能仅凭“高速版”三个字判断实际提升。
透明积分比无限次数更可信,但理解成本更高
新版最大的优点是可核算。过去以“约多少次 Prompt”描述用量,很容易让用户误以为一次提问只对应一次计费;现在输入、缓存、输出、模型等级、MCP 次数和峰谷时段都有明确系数,开发者至少能够解释额度为什么减少。
新版最大的缺点是学习成本上升。用户需要同时理解 Token、缓存命中、模型系数、MCP 系数、5 小时动态刷新、每周刷新和峰谷倍率,才能准确估计项目成本。对专业开发者而言这比黑盒限额更公平,但它并不比传统订阅更简单。
| 计量方式 | 优点 | 缺点 | 更适合谁 | | --- | --- | --- | --- | | 固定 Prompt 次数 | 容易理解、购买决策快 | 无法反映单次任务复杂度,容易产生“次数缩水”争议 | 轻量问答用户 | | 固定 Token 额度 | 易于和模型价格比较 | 难以覆盖搜索、网页读取等工具成本 | 主要使用纯模型的用户 | | 统一积分制 | 可同时覆盖多模型、缓存和 MCP | 规则较多,需要成本面板辅助理解 | 高频编码和智能体用户 | | 按量 API | 场景自由、用多少付多少 | 长任务成本波动大,可能产生超额账单 | 自建应用与工程集成 |
统一积分也不等于所有能力同价。它更像把模型和工具放进同一个钱包,但每种商品仍有不同单价:GLM-5.2 长输出消耗较高,缓存命中较低,联网搜索和网页读取则按调用次数扣除。真正决定体验的,不只是总积分,还有客户端能否清楚展示每项任务的消耗来源。
这次回归能否站稳,取决于三件事
第一件事是账单必须足够细。公开公式只是第一步,费用明细还需要把每次任务关联到模型、Token、缓存、MCP 和峰谷倍率,否则用户知道公式,也找不到是哪一次智能体任务迅速吃掉了额度。
第二件事是模型供给必须稳定。GLM Coding Plan 年初的争议不只是规则问题,也与 GLM-5 灰度开放和扩容节奏有关;如果高峰期依然频繁排队、降速或无法使用,那么低峰五折只能缓解成本,不能修复体验。
第三件事是老用户迁移入口必须按时上线。智谱给 v1 用户承诺了两周内开放购买通道,这类承诺涉及真实续订权益,执行速度会直接影响开发者对新版规则的判断。
总体来看,GLM Coding Plan 这次回归是一次必要且方向正确的修正。118 元起的门槛和低峰五折仍具吸引力,但更重要的是,智谱开始用公开系数解释模型与工具成本,而不是继续依赖模糊的“高额调用次数”。
对于每天使用 AI 编码工具的开发者,新版值得考虑;对于偶尔补全几段代码的低频用户,复杂的积分体系和自动续费反而可能没有必要。订阅前还应注意,套餐购买后不支持退款,默认会自动续费,如需取消,应至少在下一扣费日前 3 天操作。
参考来源
- IT之家:智谱 GLM Coding Plan 订阅回归,透明积分制,每月 118 元起:本次订阅回归、限时折扣、老用户权益和高速版申请信息。
- GitHub:GLM Coding Plan 社区整理:收录兼容工具、套餐活动和用户使用信息,属于非官方整理,具体额度与规则应以智谱最新公告为准。


