logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Claude Code 与 GPT Agent 重试限流:防止 Claude / ChatGPT 刷爆额度

很多 Agent 配好 Claude Code、ChatGPT API、OpenAI SDK 之后,一旦遇到超时、429、401 或流式 SSE 中断,就会进入“自动重试”死循环:上层任务没取消,下层请求继续打,最后表现为额度被刷爆、响应越来越慢、日志里全是重复请求。尤其是模型路由切换时,同一条任务可能先打 Claude,再切 GPT,再回退,重试次数被多层叠加,实际请求量远超预期。另外,模型路由

Codex CLI 换 OpenAI 兼容 base_url 后的 401 鉴权头排查

会出现“卡住几秒后退出”,表面像超时,日志里却可能先有 401 或 403。建议先关掉重试,单次请求验证:如果非流式正常、流式失败,问题通常在网关的 chunk 转发、gzip 或超时配置。如果你同时跑过 ChatGPT API、OpenAI SDK 和 Codex CLI,切到兼容端点后最常见的报错不是“模型不存在”,而是 401。多数情况不是服务挂了,而是。,会返回鉴权成功但业务失败,所以要确

用环境变量区分不同项目的 API base 和 key,避免 ChatGPT 工具链与 OpenAI SDK 串配置

同时开相关 CLI、本地 Agent 和业务里的时,最烦的是串配置:测试 key 打到生产、或 base_url 指错环境。

#ChatGPT
到底了