完整阅读体验:https://mp.weixin.qq.com/s/4_cZOStFYJ-0qF8GOrv-cQ

GLM-5.2的表现

GLM-5.2 是智谱(Z.AI) 在6月17日发布的最新旗舰模型(开源)。

🔗官网:https://bigmodel.cn/

GLM-5.2为文本输入输入模型,上下文窗口和其它顶级模型一样,为1M,最大输出128K。

在LiveBench上综合排名第7(Qwen 3.7 Max 第13,DeepSeek V4 Pro 第15,Kimi K2.7 Code 第21)。

image-20260623214336968

LiveBench :一款专为 LLM 设计的基准测试工具,充分考虑了测试集污染和客观性评估。它具有以下特性:

  • LiveBench 通过定期发布新问题来限制潜在的污染。
  • 每个问题都有可验证的、客观的真实答案,因此无需法学硕士(LLM)法官。
  • LiveBench 目前包含 7 个类别共 23 项不同的任务,我们将随着时间的推移发布新的、更难的任务。
  • URL:https://livebench.ai/#/

在LMArena 的Agent能力中排名第10(DeepSeek V4 Pro 第16,Kimi K2.7 Code 第18):

image-20260623214827071

在LMArena 的WebDev能力中排名第2(Qwen 3.7 Max 第10,DeepSeek V4 Pro 第24,Kimi K2.7 Code 第20):

image-20260623215114076

LMArena 是加州大学伯克利分校 LMSYS 组织开发维护的全球百万用户参与盲测的评估系统。

  • URL:https://arena.ai/leaderboard/code/webdev

在Artificial Analysis Intelligence Index 综合智商评估中排名第3

[外链图片转存中…(img-IMIAay6i-1782636122518)]

综合 10 项评估维度,从 “AI 智商” 角度全面衡量模型能力,包含逻辑推理、抽象思维、学习能力等。

  • URL: https://artificialanalysis.ai/

从这些排名中可以看出,GML-5.2已经是国产AI第一(梯队)的水平了。

当然了最强的还得是Claude和 GPT。

虽然Gemini我用的很多,但写代码感觉不太行,平时写个简单代码,翻译文档什么的用一下还行。

我在亲自体验后,发现GLM-5.2的确不错,比我用过的DeepSeek V4、Gemini强,但相较于Claude和GPT还差点。

GLM-5.2 价格

GLM-5.2 能力是第一梯队,价格也是。

[外链图片转存中…(img-xMGTEcoq-1782636122518)]

官网定价:

  • API(1M tokens): 输入8元,输出28元,缓存命中2元,缓存存储限时免费。

与之对比 DeepSeek token价格:

计费项deepseek-v4-flashdeepseek-v4-pro
百万 tokens 输入(缓存命中)0.02元0.025元
百万 tokens 输入(缓存未命中)1元3元
百万 tokens 输出2元6元

可以说是相当的贵了。我冲了一点钱,一次prompt就花了好几块。

相对而言,GLM Coding Plan就很划算了:

套餐类型每 5 小时限额每周限额
Lite 套餐最多约 80 次 prompts最多约 400 次 prompts
Pro 套餐最多约 400 次 prompts最多约 2000 次 prompts
Max 套餐最多约 1600 次 prompts最多约 8000 次 prompts

一次prompt指一次提问,每次 prompt 预计可调用模型 15-20 次。

每月可用额度按 API 定价折算,相当于月订阅费用的 15–30 倍(已计入周限额影响)。

  • 5小时限额:动态刷新,额度在请求消耗 5 小时后刷新重置
  • 每周限额:自下单时开启,以 7 天为一个周期额度刷新重置

其实,各家都基本如此,会员订阅比API划算。


但这个Coding Plan我抢了好几天也没买到,开始是手动,后面换成脚本,都无济于事。智谱的算力还是不太够用啊。

image-20260623221429420

其它使用GLM-5.2的方式

(1)免费额度

第一个就是新用户免费送的200w可用于5.2的token了。

另外,使用它们的zcode也会连续送5天(每日 GLM-5.2 300 万 + GLM-5-turbo 200 万)。

但这些其实很少,几百万token一个项目都做不完的。

🔗zcode官网:https://zcode.z.ai/cn/docs/welcome

(2)opencode Go套餐

opencode是开源的 AI 编程智能体(Agent)。

opencode有一个Go套餐,(为国外用户)提供了GLM、Kimi、MiMo、MiniMax、Qwen和DeepSeek 模型。

具体模型列表:

  • GLM-5.2、GLM-5.1
  • Kimi K2.7 Code、Kimi K2.6
  • MiMo-V2.5、MiMo-V2.5-Pro
  • MiniMax M3、MiniMax M2.7
  • Qwen3.7 Max、Qwen3.7 Plus、Qwen3.6 Plus
  • DeepSeek V4 Pro、DeepSeek V4 Flash

虽然是opencode Go旨在为国外用户提供价格亲和、能力顶尖的模型,但国内用户也是可以订阅的(支持支付宝)。

首月价格5美元,后续10美元(你也可以用不同的账号多白嫖几个5美元的)。

额度限制:

  • 5 小时限制 — 12 美元使用额度
  • 每周限制 — 30 美元使用额度
  • 每月限制 — 60 美元使用额度

即5美元当60美元用。

具体请求数:

Model每 5 小时请求数每周请求数每月请求数
GLM-5.28802,1504,300
GLM-5.18802,1504,300
Kimi K2.61,1502,8805,750
Kimi K2.7 Code1,3504,6309,250
MiMo-V2.530,10075,200150,400
MiMo-V2.5-Pro3,2508,15016,300
MiniMax M33,2008,00016,000
MiniMax M2.73,4008,50017,000
Qwen3.7 Max9502,3904,770
Qwen3.7 Plus4,30010,80021,600
Qwen3.6 Plus3,3008,20016,300
DeepSeek V4 Pro3,4508,55017,150
DeepSeek V4 Flash31,65079,050158,150

当然你也可以通过opencode Zen,使用Claude Fable 5、GPT-5.5 Pro 这样的顶尖模型。Zen属于API调用了,即先充值,再消费,没有Go那样的优惠,很贵,不推荐,你可以看两个模型价格(每 1M tokens):

模型输入输出缓存读取缓存写入
Claude Fable 5$10$50$1$12
GPT 5.5 Pro$30$180$30

真是一用一个不吱声啊。

开openai或者Claude的相关会员,用这些模型,额度消耗也是飞速。

如果你要尝试Go套餐,可以使用我的要求链接:https://opencode.ai/go?ref=VH6HNYB1GE

你和我都能获得5美元的Go额度。

启用这个额度:在官网的Go页面点击下图中的3个地方

1

opencode Go可以使用他家的opencode客户端,也可以通过CC Switch,在Claude Code里面使用,CC Switch已经内置这个Provider了,填写API Key,获取模型列表就可以了。


(3)方舟 Agent Plan

火山引擎的 Agent Plan也有GLM-5.2了,以及其它国内模型。

现在的优惠力度挺大的:

image-20260623224024594

注意:这个支付后是开启自动续费的,第三个月续费价格就变成200了(Medium套餐),记得关闭续费(如果有必要)。

  • 订阅价格优惠:2.5折优惠是首2个元月,第三个月起恢复原价。优惠时间:2026年6月8日至2026年8月8日
  • 用量优惠:4倍额度,时间:2026年6月10日18:00:00至2026年6月30日23:59:59,适用模型: deepseek-v4-pro、kimi-k2.6、kimi-k2.7-code、glm-5.2。

限额时间:

  • 5小时限额:从首次使用计时
  • 周、日限额:每周一0点和每天0点重置
  • 月限额:付款的那天计算(如6月20日订阅,7月1日不会重置额度,月额度重置是7月20日0点)

🔗方舟 Agent Plan链接:https://www.volcengine.com/activity/agentplan

支持的AI工具:

image-20260623230612649

火山方舟是字节跳动的,它主推的肯定是自家的豆包模型。

在Claude Code中使用

官网有文档:https://www.volcengine.com/docs/82379/2373738?lang=zh

也可以通过CC Switch来配置,已经内置方舟的Coding Plan配置了,虽然名称是火山Agentplan,但里面预置的请求地址是CodingPlan的,需要手动改成Agent Plan:https://ark.cn-beijing.volces.com/api/plan

在火山方舟的控制台–开通管理–Agent Plan选项下,可以配置API Key。

新版控制台:https://console.volcengine.com/ark/region:cn-beijing/subscription/agent-plan

codex里面也可以使用,支持Responses API,请求地址:https://ark.cn-beijing.volces.com/api/plan/v3

我使用的是CC switch,这样方便管理不同的 Provider。

对比

我之前是订阅了2个opencode Go,做了一个Typora主题,并将它同步为微信公众号编辑器了,这两个小项目加起来用了2个Go套餐的34%。

感觉是不太够用。

做的项目如下:

Typora主题:https://github.com/LingyunStudio/vlook-lingyun

公众号编辑器:

  • GitHub:https://github.com/LingyunStudio/WeWrite

  • 已部署:https://wewrite.lingyun888.top/

  • 具体样式就是本文呈现的这样,完整样式可以看部署的那个链接,Typora里面看到的也是一样的。

而方舟 Agent Plan的额度虽然多,但是速率限制方面存在问题,如下图,已经显示速率限制了,但控制台显示的5小时、一周限额远没达到限额值。

[外链图片转存中…(img-v2ClKMl8-1782636122518)]

image-20260624155819633

对此,售后的解释是:

image-20260624162602466

[外链图片转存中…(img-IF8bVCGC-1782636122518)]

文章开头就说过,GLM-5.2是开源的,opencode和火山方舟都是部署在自己的服务器上的。但是由于这个模型很强,白天高峰期使用的人很多,会算力不足,任务需要排队。

据说智谱官方coding plan白天高峰期也是类似的(毕竟连套餐都是限额抢购的,算力不足是肯定的)。

我现在的解决方法就是:

  • 使用Claude code编码
  • Claude code同时配置opencode的Go套餐和火山Agent Plan
  • 使用CC Switch来管理这2个Provider
  • 一个限速的时候,切换另一个Provider
image-20260624164829703

截至今天,最新的 CC Switch 3.16.3 有个“Bug”,上下文勾选1M,但是Claude Code里面显示只有200k,ISSUE #4353、#4551、#4565。之前的版本是正常的。

  • 一个限速的时候,切换另一个Provider
image-20260624164829703

截至今天,最新的 CC Switch 3.16.3 有个“Bug”,上下文勾选1M,但是Claude Code里面显示只有200k,ISSUE #4353、#4551、#4565。之前的版本是正常的。

更多推荐