
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
上周我把 Codex CLI 升到最新版,想着终于能用 GPT-5.5 跑代码生成了。结果折腾了大半天,发现生成质量明显不对——后来抓了下请求日志,好家伙,model 字段写的是gpt-5.5,实际 API 路由到的还是旧版。这个坑不止我一个人踩,掘金好几篇实战帖评论区都有人问"为什么感觉没变化"。今天把完整的配置流程、正确的 model 字段写法、API key 权限 scope、以及沙箱超时参
这是我折腾最久的部分。因为静默 fallback 的存在,你没法从 UI 上看出区别。方法一:看响应延迟不同模型和不同平台的首 token 延迟存在差异,但具体数值受网络环境、服务器负载等因素影响较大,不适合作为硬性判断标准。如果切换后延迟风格明显不同,可以作为辅助参考。方法二:问它是谁在 Cascade 里直接输入"你是什么模型"。虽然不是 100% 可靠(有些模型会被 system promp
2026 年 6 月中文开发者社区出现大量 ChatGPT 和 Codex 账号被封的情况。本文按"共性原因 4 条 + Codex/开发者特有 2 条"分类,提供自查清单,并对比申诉、合规 API 网关等应对方案。
6 月 3 号早上刷 HN,看到传闻称 xAI(马斯克旗下 AI 公司)拟以某价格收购 Cursor 的消息(具体金额系未经官方证实的传闻数字,各方流传版本不一),说实话第一反应不是"卧槽好厉害",而是"完了,我的 BYOK 配置会不会被动"。Cursor 被收购后 API 后端策略会不会变、custom model endpoint 还让不让用、甚至 Base URL 字段会不会直接砍掉——这些
上周三我想把 Codex CLI 接到项目里替代部分 Claude Code 的工作流,结果光一个 config.yaml 就来回改了三遍才跑通。问题出在两个地方:provider 的枚举值拼写(openai和你以为的行为完全不一样),以及 api_key 到底读环境变量还是读配置文件——官方文档对这俩的优先级描述基本等于没写。这篇把我踩的坑和最终能用的最小配置模板都贴出来,省得你也折腾半天。
上个月我把 Codex Agent 当主力用,Skills 生态刚起来那会儿什么都往里塞,高峰期里注册了 34 个 Skill。然后月底一看账单——$187,比上个月翻了将近一倍。排查了两天才发现,有些 Skill 的写得太模糊,导致 Agent 几乎每轮对话都会触发它们做一次"试探性调用",白白烧 token。这篇把我踩过的坑、最终留下的 7 个 Skill、以及里最容易写错的字段全部摊开讲。
上周三我们团队的 RAG pipeline 突然集体趴窝,日志里刷了满屏的和。当时正好赶上 Claude Opus 4.7 发布后的流量高峰,Anthropic 官方 API 基本每隔几分钟就 529 一次,搞得我那天下午什么正事都没干,全在折腾重试逻辑。直接说结论:Claude API 返回 529 overloaded 本质是 Anthropic 服务端过载限流,你客户端能做的就三件事——指数
上周三智谱把 GLM-4 开源版放出来,我当天晚上就拉了权重往本地部署。心想云端 GLM-4 的 API 我已经跑通了,开源版应该改个端口就完事——结果接了两遍,踩了三个坑,折腾到凌晨两点才把 chat completions 跑通。,但官方文档混在一起写,第一次接必踩。这篇把三处差异拆开讲清楚,附完整代码和报错排查。
上个月老板突然说要搞个微信客服机器人,能自动回复产品咨询、处理售后问题,还得接大模型让回复"像人"。我看了眼掘金热榜,OpenClaw 刚好在风口上,就花了三天时间从零搭了一套出来。踩坑不少,但最终效果还行——日均处理 400+ 条消息,客户满意度从 62% 拉到了 89%。这篇把完整流程和坑都记下来。OpenClaw 本质是一个 AI Agent 运行框架,通过它的微信协议适配层(基于 itch
上个月老板突然说要搞个微信客服机器人,能自动回复产品咨询、处理售后问题,还得接大模型让回复"像人"。我看了眼掘金热榜,OpenClaw 刚好在风口上,就花了三天时间从零搭了一套出来。踩坑不少,但最终效果还行——日均处理 400+ 条消息,客户满意度从 62% 拉到了 89%。这篇把完整流程和坑都记下来。OpenClaw 本质是一个 AI Agent 运行框架,通过它的微信协议适配层(基于 itch







