
简介
该用户还未填写简介
擅长的技术栈
未填写擅长的技术栈
可提供的服务
暂无可提供的服务
Agent 重试环里的限流:防止 Claude / GPT 刷爆额度
x-request-id`\n- 关闭 SDK 默认无限重试,改成显式重试\n- 监控按“请求数 / 成功数 / 429 数 / token 消耗”四列看\n- 对“模型路由表”做灰度,先把高频 Agent 接到低风险模型,再逐步切 GPT / Claude\n\n如果你在迁移 Claude Code、ChatGPT API 或 OpenAI SDK 时经常遇到“明明没发很多请求,却突然限流”的情
Claude Code、ChatGPT API 迁到 OpenAI-compatible:base_url 配置与排错检查清单
但真正上线后最容易出问题的反而是环境变量串配、模型名路由、流式返回格式不一致,以及超时策略没同步。尤其是 Claude Code、Codex CLI、OpenAI SDK 这几类工具,表面都支持 OpenAI 风格调用,实际在鉴权头、SSE 断流、重试机制上还是有细节差异。我的建议是,先按“配置—连通—流式—模型—回滚”五步走,别直接全量替换。不要先怀疑模型,先查请求头是否真的带上 key,特别是
到底了







