logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Agent 重试环里的限流:防止 Claude / GPT 刷爆额度

x-request-id`\n- 关闭 SDK 默认无限重试,改成显式重试\n- 监控按“请求数 / 成功数 / 429 数 / token 消耗”四列看\n- 对“模型路由表”做灰度,先把高频 Agent 接到低风险模型,再逐步切 GPT / Claude\n\n如果你在迁移 Claude Code、ChatGPT API 或 OpenAI SDK 时经常遇到“明明没发很多请求,却突然限流”的情

#人工智能#ChatGPT
Claude Code、ChatGPT API 迁到 OpenAI-compatible:base_url 配置与排错检查清单

但真正上线后最容易出问题的反而是环境变量串配、模型名路由、流式返回格式不一致,以及超时策略没同步。尤其是 Claude Code、Codex CLI、OpenAI SDK 这几类工具,表面都支持 OpenAI 风格调用,实际在鉴权头、SSE 断流、重试机制上还是有细节差异。我的建议是,先按“配置—连通—流式—模型—回滚”五步走,别直接全量替换。不要先怀疑模型,先查请求头是否真的带上 key,特别是

到底了