完整阅读体验:https://mp.weixin.qq.com/s/4_cZOStFYJ-0qF8GOrv-cQ

GLM-5.2的表现

GLM-5.2 是智谱(Z.AI) 在6月17日发布的最新旗舰模型(开源)。

🔗官网:https://bigmodel.cn/

GLM-5.2为文本输入输入模型,上下文窗口和其它顶级模型一样,为1M,最大输出128K。

在LiveBench上综合排名第7(Qwen 3.7 Max 第13,DeepSeek V4 Pro 第15,Kimi K2.7 Code 第21)。

image-20260623214336968

LiveBench :一款专为 LLM 设计的基准测试工具,充分考虑了测试集污染和客观性评估。它具有以下特性:

  • LiveBench 通过定期发布新问题来限制潜在的污染。
  • 每个问题都有可验证的、客观的真实答案,因此无需法学硕士(LLM)法官。
  • LiveBench 目前包含 7 个类别共 23 项不同的任务,我们将随着时间的推移发布新的、更难的任务。
  • URL:https://livebench.ai/#/

在LMArena 的Agent能力中排名第10(DeepSeek V4 Pro 第16,Kimi K2.7 Code 第18):

image-20260623214827071

在LMArena 的WebDev能力中排名第2(Qwen 3.7 Max 第10,DeepSeek V4 Pro 第24,Kimi K2.7 Code 第20):

image-20260623215114076

LMArena 是加州大学伯克利分校 LMSYS 组织开发维护的全球百万用户参与盲测的评估系统。

  • URL:https://arena.ai/leaderboard/code/webdev

在Artificial Analysis Intelligence Index 综合智商评估中排名第3

[外链图片转存中…(img-IMIAay6i-1782636122518)]

综合 10 项评估维度,从 “AI 智商” 角度全面衡量模型能力,包含逻辑推理、抽象思维、学习能力等。

  • URL: https://artificialanalysis.ai/

从这些排名中可以看出,GML-5.2已经是国产AI第一(梯队)的水平了。

当然了最强的还得是Claude和 GPT。

虽然Gemini我用的很多,但写代码感觉不太行,平时写个简单代码,翻译文档什么的用一下还行。

我在亲自体验后,发现GLM-5.2的确不错,比我用过的DeepSeek V4、Gemini强,但相较于Claude和GPT还差点。

GLM-5.2 价格

GLM-5.2 能力是第一梯队,价格也是。

[外链图片转存中…(img-xMGTEcoq-1782636122518)]

官网定价:

  • API(1M tokens): 输入8元,输出28元,缓存命中2元,缓存存储限时免费。

与之对比 DeepSeek token价格:

计费项 deepseek-v4-flash deepseek-v4-pro
百万 tokens 输入(缓存命中) 0.02元 0.025元
百万 tokens 输入(缓存未命中) 1元 3元
百万 tokens 输出 2元 6元

可以说是相当的贵了。我冲了一点钱,一次prompt就花了好几块。

相对而言,GLM Coding Plan就很划算了:

套餐类型 每 5 小时限额 每周限额
Lite 套餐 最多约 80 次 prompts 最多约 400 次 prompts
Pro 套餐 最多约 400 次 prompts 最多约 2000 次 prompts
Max 套餐 最多约 1600 次 prompts 最多约 8000 次 prompts

一次prompt指一次提问,每次 prompt 预计可调用模型 15-20 次。

每月可用额度按 API 定价折算,相当于月订阅费用的 15–30 倍(已计入周限额影响)。

  • 5小时限额:动态刷新,额度在请求消耗 5 小时后刷新重置
  • 每周限额:自下单时开启,以 7 天为一个周期额度刷新重置

其实,各家都基本如此,会员订阅比API划算。


但这个Coding Plan我抢了好几天也没买到,开始是手动,后面换成脚本,都无济于事。智谱的算力还是不太够用啊。

image-20260623221429420

其它使用GLM-5.2的方式

(1)免费额度

第一个就是新用户免费送的200w可用于5.2的token了。

另外,使用它们的zcode也会连续送5天(每日 GLM-5.2 300 万 + GLM-5-turbo 200 万)。

但这些其实很少,几百万token一个项目都做不完的。

🔗zcode官网:https://zcode.z.ai/cn/docs/welcome

(2)opencode Go套餐

opencode是开源的 AI 编程智能体(Agent)。

opencode有一个Go套餐,(为国外用户)提供了GLM、Kimi、MiMo、MiniMax、Qwen和DeepSeek 模型。

具体模型列表:

  • GLM-5.2、GLM-5.1
  • Kimi K2.7 Code、Kimi K2.6
  • MiMo-V2.5、MiMo-V2.5-Pro
  • MiniMax M3、MiniMax M2.7
  • Qwen3.7 Max、Qwen3.7 Plus、Qwen3.6 Plus
  • DeepSeek V4 Pro、DeepSeek V4 Flash

虽然是opencode Go旨在为国外用户提供价格亲和、能力顶尖的模型,但国内用户也是可以订阅的(支持支付宝)。

首月价格5美元,后续10美元(你也可以用不同的账号多白嫖几个5美元的)。

额度限制:

  • 5 小时限制 — 12 美元使用额度
  • 每周限制 — 30 美元使用额度
  • 每月限制 — 60 美元使用额度

即5美元当60美元用。

具体请求数:

Model 每 5 小时请求数 每周请求数 每月请求数
GLM-5.2 880 2,150 4,300
GLM-5.1 880 2,150 4,300
Kimi K2.6 1,150 2,880 5,750
Kimi K2.7 Code 1,350 4,630 9,250
MiMo-V2.5 30,100 75,200 150,400
MiMo-V2.5-Pro 3,250 8,150 16,300
MiniMax M3 3,200 8,000 16,000
MiniMax M2.7 3,400 8,500 17,000
Qwen3.7 Max 950 2,390 4,770
Qwen3.7 Plus 4,300 10,800 21,600
Qwen3.6 Plus 3,300 8,200 16,300
DeepSeek V4 Pro 3,450 8,550 17,150
DeepSeek V4 Flash 31,650 79,050 158,150

当然你也可以通过opencode Zen,使用Claude Fable 5、GPT-5.5 Pro 这样的顶尖模型。Zen属于API调用了,即先充值,再消费,没有Go那样的优惠,很贵,不推荐,你可以看两个模型价格(每 1M tokens):

模型 输入 输出 缓存读取 缓存写入
Claude Fable 5 $10 $50 $1 $12
GPT 5.5 Pro $30 $180 $30

真是一用一个不吱声啊。

开openai或者Claude的相关会员,用这些模型,额度消耗也是飞速。

如果你要尝试Go套餐,可以使用我的要求链接:https://opencode.ai/go?ref=VH6HNYB1GE

你和我都能获得5美元的Go额度。

启用这个额度:在官网的Go页面点击下图中的3个地方

1

opencode Go可以使用他家的opencode客户端,也可以通过CC Switch,在Claude Code里面使用,CC Switch已经内置这个Provider了,填写API Key,获取模型列表就可以了。


(3)方舟 Agent Plan

火山引擎的 Agent Plan也有GLM-5.2了,以及其它国内模型。

现在的优惠力度挺大的:

image-20260623224024594

注意:这个支付后是开启自动续费的,第三个月续费价格就变成200了(Medium套餐),记得关闭续费(如果有必要)。

  • 订阅价格优惠:2.5折优惠是首2个元月,第三个月起恢复原价。优惠时间:2026年6月8日至2026年8月8日
  • 用量优惠:4倍额度,时间:2026年6月10日18:00:00至2026年6月30日23:59:59,适用模型: deepseek-v4-pro、kimi-k2.6、kimi-k2.7-code、glm-5.2。

限额时间:

  • 5小时限额:从首次使用计时
  • 周、日限额:每周一0点和每天0点重置
  • 月限额:付款的那天计算(如6月20日订阅,7月1日不会重置额度,月额度重置是7月20日0点)

🔗方舟 Agent Plan链接:https://www.volcengine.com/activity/agentplan

支持的AI工具:

image-20260623230612649

火山方舟是字节跳动的,它主推的肯定是自家的豆包模型。

在Claude Code中使用

官网有文档:https://www.volcengine.com/docs/82379/2373738?lang=zh

也可以通过CC Switch来配置,已经内置方舟的Coding Plan配置了,虽然名称是火山Agentplan,但里面预置的请求地址是CodingPlan的,需要手动改成Agent Plan:https://ark.cn-beijing.volces.com/api/plan

在火山方舟的控制台–开通管理–Agent Plan选项下,可以配置API Key。

新版控制台:https://console.volcengine.com/ark/region:cn-beijing/subscription/agent-plan

codex里面也可以使用,支持Responses API,请求地址:https://ark.cn-beijing.volces.com/api/plan/v3

我使用的是CC switch,这样方便管理不同的 Provider。

对比

我之前是订阅了2个opencode Go,做了一个Typora主题,并将它同步为微信公众号编辑器了,这两个小项目加起来用了2个Go套餐的34%。

感觉是不太够用。

做的项目如下:

Typora主题:https://github.com/LingyunStudio/vlook-lingyun

公众号编辑器:

  • GitHub:https://github.com/LingyunStudio/WeWrite

  • 已部署:https://wewrite.lingyun888.top/

  • 具体样式就是本文呈现的这样,完整样式可以看部署的那个链接,Typora里面看到的也是一样的。

而方舟 Agent Plan的额度虽然多,但是速率限制方面存在问题,如下图,已经显示速率限制了,但控制台显示的5小时、一周限额远没达到限额值。

[外链图片转存中…(img-v2ClKMl8-1782636122518)]

image-20260624155819633

对此,售后的解释是:

image-20260624162602466

[外链图片转存中…(img-IF8bVCGC-1782636122518)]

文章开头就说过,GLM-5.2是开源的,opencode和火山方舟都是部署在自己的服务器上的。但是由于这个模型很强,白天高峰期使用的人很多,会算力不足,任务需要排队。

据说智谱官方coding plan白天高峰期也是类似的(毕竟连套餐都是限额抢购的,算力不足是肯定的)。

我现在的解决方法就是:

  • 使用Claude code编码
  • Claude code同时配置opencode的Go套餐和火山Agent Plan
  • 使用CC Switch来管理这2个Provider
  • 一个限速的时候,切换另一个Provider
image-20260624164829703

截至今天,最新的 CC Switch 3.16.3 有个“Bug”,上下文勾选1M,但是Claude Code里面显示只有200k,ISSUE #4353、#4551、#4565。之前的版本是正常的。

  • 一个限速的时候,切换另一个Provider
image-20260624164829703

截至今天,最新的 CC Switch 3.16.3 有个“Bug”,上下文勾选1M,但是Claude Code里面显示只有200k,ISSUE #4353、#4551、#4565。之前的版本是正常的。

更多推荐