GLM-5.2 性能跻身第一梯队,可惜智谱的GLM Coding Plan真难抢啊
GLM-5.2的表现
GLM-5.2 是智谱(Z.AI) 在6月17日发布的最新旗舰模型(开源)。
🔗官网:https://bigmodel.cn/
GLM-5.2为文本输入输入模型,上下文窗口和其它顶级模型一样,为1M,最大输出128K。
在LiveBench上综合排名第7(Qwen 3.7 Max 第13,DeepSeek V4 Pro 第15,Kimi K2.7 Code 第21)。

LiveBench :一款专为 LLM 设计的基准测试工具,充分考虑了测试集污染和客观性评估。它具有以下特性:
- LiveBench 通过定期发布新问题来限制潜在的污染。
- 每个问题都有可验证的、客观的真实答案,因此无需法学硕士(LLM)法官。
- LiveBench 目前包含 7 个类别共 23 项不同的任务,我们将随着时间的推移发布新的、更难的任务。
URL:https://livebench.ai/#/
在LMArena 的Agent能力中排名第10(DeepSeek V4 Pro 第16,Kimi K2.7 Code 第18):
在LMArena 的WebDev能力中排名第2(Qwen 3.7 Max 第10,DeepSeek V4 Pro 第24,Kimi K2.7 Code 第20):
LMArena 是加州大学伯克利分校 LMSYS 组织开发维护的全球百万用户参与盲测的评估系统。
- URL:https://arena.ai/leaderboard/code/webdev
在Artificial Analysis Intelligence Index 综合智商评估中排名第3:
[外链图片转存中…(img-IMIAay6i-1782636122518)]
综合 10 项评估维度,从 “AI 智商” 角度全面衡量模型能力,包含逻辑推理、抽象思维、学习能力等。
- URL: https://artificialanalysis.ai/
从这些排名中可以看出,GML-5.2已经是国产AI第一(梯队)的水平了。
当然了最强的还得是Claude和 GPT。
虽然Gemini我用的很多,但写代码感觉不太行,平时写个简单代码,翻译文档什么的用一下还行。
我在亲自体验后,发现GLM-5.2的确不错,比我用过的DeepSeek V4、Gemini强,但相较于Claude和GPT还差点。
GLM-5.2 价格
GLM-5.2 能力是第一梯队,价格也是。
[外链图片转存中…(img-xMGTEcoq-1782636122518)]
官网定价:
- API(1M tokens): 输入8元,输出28元,缓存命中2元,缓存存储限时免费。
与之对比 DeepSeek token价格:
| 计费项 | deepseek-v4-flash | deepseek-v4-pro |
|---|---|---|
| 百万 tokens 输入(缓存命中) | 0.02元 | 0.025元 |
| 百万 tokens 输入(缓存未命中) | 1元 | 3元 |
| 百万 tokens 输出 | 2元 | 6元 |
可以说是相当的贵了。我冲了一点钱,一次prompt就花了好几块。
相对而言,GLM Coding Plan就很划算了:
| 套餐类型 | 每 5 小时限额 | 每周限额 |
|---|---|---|
| Lite 套餐 | 最多约 80 次 prompts | 最多约 400 次 prompts |
| Pro 套餐 | 最多约 400 次 prompts | 最多约 2000 次 prompts |
| Max 套餐 | 最多约 1600 次 prompts | 最多约 8000 次 prompts |
一次prompt指一次提问,每次 prompt 预计可调用模型 15-20 次。
每月可用额度按 API 定价折算,相当于月订阅费用的 15–30 倍(已计入周限额影响)。
- 5小时限额:动态刷新,额度在请求消耗 5 小时后刷新重置
- 每周限额:自下单时开启,以 7 天为一个周期额度刷新重置
其实,各家都基本如此,会员订阅比API划算。
但这个Coding Plan我抢了好几天也没买到,开始是手动,后面换成脚本,都无济于事。智谱的算力还是不太够用啊。
其它使用GLM-5.2的方式
(1)免费额度
第一个就是新用户免费送的200w可用于5.2的token了。
另外,使用它们的zcode也会连续送5天(每日 GLM-5.2 300 万 + GLM-5-turbo 200 万)。
但这些其实很少,几百万token一个项目都做不完的。
🔗zcode官网:https://zcode.z.ai/cn/docs/welcome
(2)opencode Go套餐
opencode是开源的 AI 编程智能体(Agent)。
opencode有一个Go套餐,(为国外用户)提供了GLM、Kimi、MiMo、MiniMax、Qwen和DeepSeek 模型。
具体模型列表:
- GLM-5.2、GLM-5.1
- Kimi K2.7 Code、Kimi K2.6
- MiMo-V2.5、MiMo-V2.5-Pro
- MiniMax M3、MiniMax M2.7
- Qwen3.7 Max、Qwen3.7 Plus、Qwen3.6 Plus
- DeepSeek V4 Pro、DeepSeek V4 Flash
虽然是opencode Go旨在为国外用户提供价格亲和、能力顶尖的模型,但国内用户也是可以订阅的(支持支付宝)。
首月价格5美元,后续10美元(你也可以用不同的账号多白嫖几个5美元的)。
额度限制:
- 5 小时限制 — 12 美元使用额度
- 每周限制 — 30 美元使用额度
- 每月限制 — 60 美元使用额度
即5美元当60美元用。
具体请求数:
| Model | 每 5 小时请求数 | 每周请求数 | 每月请求数 |
|---|---|---|---|
| GLM-5.2 | 880 | 2,150 | 4,300 |
| GLM-5.1 | 880 | 2,150 | 4,300 |
| Kimi K2.6 | 1,150 | 2,880 | 5,750 |
| Kimi K2.7 Code | 1,350 | 4,630 | 9,250 |
| MiMo-V2.5 | 30,100 | 75,200 | 150,400 |
| MiMo-V2.5-Pro | 3,250 | 8,150 | 16,300 |
| MiniMax M3 | 3,200 | 8,000 | 16,000 |
| MiniMax M2.7 | 3,400 | 8,500 | 17,000 |
| Qwen3.7 Max | 950 | 2,390 | 4,770 |
| Qwen3.7 Plus | 4,300 | 10,800 | 21,600 |
| Qwen3.6 Plus | 3,300 | 8,200 | 16,300 |
| DeepSeek V4 Pro | 3,450 | 8,550 | 17,150 |
| DeepSeek V4 Flash | 31,650 | 79,050 | 158,150 |
当然你也可以通过opencode Zen,使用Claude Fable 5、GPT-5.5 Pro 这样的顶尖模型。Zen属于API调用了,即先充值,再消费,没有Go那样的优惠,很贵,不推荐,你可以看两个模型价格(每 1M tokens):
| 模型 | 输入 | 输出 | 缓存读取 | 缓存写入 |
|---|---|---|---|---|
| Claude Fable 5 | $10 | $50 | $1 | $12 |
| GPT 5.5 Pro | $30 | $180 | $30 | – |
真是一用一个不吱声啊。
开openai或者Claude的相关会员,用这些模型,额度消耗也是飞速。
如果你要尝试Go套餐,可以使用我的要求链接:https://opencode.ai/go?ref=VH6HNYB1GE
你和我都能获得5美元的Go额度。
启用这个额度:在官网的Go页面点击下图中的3个地方
opencode Go可以使用他家的opencode客户端,也可以通过CC Switch,在Claude Code里面使用,CC Switch已经内置这个Provider了,填写API Key,获取模型列表就可以了。
(3)方舟 Agent Plan
火山引擎的 Agent Plan也有GLM-5.2了,以及其它国内模型。
现在的优惠力度挺大的:
注意:这个支付后是开启自动续费的,第三个月续费价格就变成200了(Medium套餐),记得关闭续费(如果有必要)。
- 订阅价格优惠:2.5折优惠是首2个元月,第三个月起恢复原价。优惠时间:2026年6月8日至2026年8月8日
- 用量优惠:4倍额度,时间:2026年6月10日18:00:00至2026年6月30日23:59:59,适用模型: deepseek-v4-pro、kimi-k2.6、kimi-k2.7-code、glm-5.2。
限额时间:
- 5小时限额:从首次使用计时
- 周、日限额:每周一0点和每天0点重置
- 月限额:付款的那天计算(如6月20日订阅,7月1日不会重置额度,月额度重置是7月20日0点)
🔗方舟 Agent Plan链接:https://www.volcengine.com/activity/agentplan
支持的AI工具:
火山方舟是字节跳动的,它主推的肯定是自家的豆包模型。
在Claude Code中使用
官网有文档:https://www.volcengine.com/docs/82379/2373738?lang=zh
也可以通过CC Switch来配置,已经内置方舟的Coding Plan配置了,虽然名称是火山Agentplan,但里面预置的请求地址是CodingPlan的,需要手动改成Agent Plan:https://ark.cn-beijing.volces.com/api/plan
在火山方舟的控制台–开通管理–Agent Plan选项下,可以配置API Key。
新版控制台:https://console.volcengine.com/ark/region:cn-beijing/subscription/agent-plan
codex里面也可以使用,支持Responses API,请求地址:https://ark.cn-beijing.volces.com/api/plan/v3
我使用的是CC switch,这样方便管理不同的 Provider。
对比
我之前是订阅了2个opencode Go,做了一个Typora主题,并将它同步为微信公众号编辑器了,这两个小项目加起来用了2个Go套餐的34%。
感觉是不太够用。
做的项目如下:
Typora主题:https://github.com/LingyunStudio/vlook-lingyun
公众号编辑器:
GitHub:https://github.com/LingyunStudio/WeWrite
已部署:https://wewrite.lingyun888.top/
具体样式就是本文呈现的这样,完整样式可以看部署的那个链接,Typora里面看到的也是一样的。
而方舟 Agent Plan的额度虽然多,但是速率限制方面存在问题,如下图,已经显示速率限制了,但控制台显示的5小时、一周限额远没达到限额值。
[外链图片转存中…(img-v2ClKMl8-1782636122518)]
对此,售后的解释是:

[外链图片转存中…(img-IF8bVCGC-1782636122518)]
文章开头就说过,GLM-5.2是开源的,opencode和火山方舟都是部署在自己的服务器上的。但是由于这个模型很强,白天高峰期使用的人很多,会算力不足,任务需要排队。
据说智谱官方coding plan白天高峰期也是类似的(毕竟连套餐都是限额抢购的,算力不足是肯定的)。
我现在的解决方法就是:
- 使用Claude code编码
- Claude code同时配置opencode的Go套餐和火山Agent Plan
- 使用CC Switch来管理这2个Provider
- 一个限速的时候,切换另一个Provider
截至今天,最新的 CC Switch 3.16.3 有个“Bug”,上下文勾选1M,但是Claude Code里面显示只有200k,ISSUE #4353、#4551、#4565。之前的版本是正常的。
- 一个限速的时候,切换另一个Provider
截至今天,最新的 CC Switch 3.16.3 有个“Bug”,上下文勾选1M,但是Claude Code里面显示只有200k,ISSUE #4353、#4551、#4565。之前的版本是正常的。
更多推荐

所有评论(0)