logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Kimi K2 API 报 400 和流式挂起怎么办?3 个文档没写的坑和规避方案

问题触发条件报错信息实际原因规避方案system 超限system prompt > ~12K tokens(实测值,非官方)单轮 system 疑似有隐藏上限拆分到 user 轮tool_call_id 不匹配多轮 tool use 后 id 对不上格式校验比 OpenAI 严格发送前校验 id 一致性流式不关闭max_tokens 截断 + stream=true无报错,连接挂起疑似 bug:

#java#数据库#前端 +1
Windsurf 换 Qwen3.7 Plus 当后端,这几个 context window 字段不设对就静默截断

上周三我把 Windsurf Cascade 的后端模型从 Claude Sonnet 换成 Qwen3.7 Plus,想省点钱跑日常的代码补全和重构任务。结果折腾了大半天——Cascade 生成到一半突然停了,不报错,不提示,就是静默截断。查了两个小时才发现是里的和maxTokens字段跟 Qwen3.7 Plus 的实际上限对不上。这篇把我踩的坑全拆一遍,直接贴配置。

#javascript#开发语言#ecmascript +1
GLM-5 云端版 API 接入实战:从 Token 获取到 model name 踩坑,OpenAI SDK / zhipuai 双路径配置指南

上个月智谱把 GLM-5 正式推上了云端推理服务,我第一时间拿开源版那套代码去对接——结果请求全部悄悄切换到了 GLM-4-Plus,返回质量明显不对。折腾了大半天才发现,云端正式版的 inference endpoint 格式和开源版完全不一样,model name 字段还必须带-turbo后缀,不带的话接口不报错但实际跑的是旧模型。这篇把我踩过的坑全部整理出来,从 access token 获

#AI
DeepSeek V3 升级后请求 500?两个常见请求格式问题排查指南

最近把项目里的 DeepSeek V3 升级到新版本,结果同一套代码开始出现 500 错误。错误信息只有一句冷冰冰的,没有任何有用的字段提示。排查下来,主要集中在两类请求格式问题:① system message 里混入了 Unicode 控制字符;② tools 参数传了空数组[]。下面展开讲怎么排查和修。:本文基于实际排查经验整理,部分涉及模型内部行为的描述(如版本间容错差异)为推测,Deep

#服务器#java#数据库 +1
Claude Sonnet 5 接入 Cursor 完整配置教程:model_name 填 claude-sonnet-4-5 还是 claude-sonnet-5?thinking 参数和 Opus

上周三我们团队把 Cursor 里的默认模型从 Claude Sonnet 4.6 升级到 Claude Sonnet 5,结果三个人填了三种不同的 model_name,全部 400 报错。折腾半天才搞清楚——Claude Sonnet 5 在 Cursor 里的正确模型 ID 是,不是,也不是。另外 thinking 参数的写法跟 Claude Opus 4.8 有所不同,两者都需要显式声明t

#java#前端#服务器 +1
开发团队同时跑 deepseek-v4-pro、glm-5、kimi-k2.7-code,3 个平台的 Key 怎么统一管不乱——踩了 6 周坑后的实战方案

上个月我们组接了一个 RAG + 代码生成的混合项目,后端同时调 deepseek-v4-pro 做推理、glm-5 做知识问答、kimi-k2.7-code 做代码补全。三个厂商、三套 Key、三种 base_url 格式——6 周里因为 Key 管理混乱导致了 4 次线上 429、2 次 401 误报、1 次某同事把测试 Key 推到了 GitHub 公开仓库。最终我们的结论是:业务代码里不应

#AI
claude-sonnet-5 + Claude Code MCP Server 配置教程:subagents 权限的三处隐藏差异(附 claude-opus-4.8 对比)

标题:claude-sonnet-5 + Claude Code MCP Server 配置教程:subagents 权限的三处隐藏差异(附 claude-opus-4.8 对比)正文:上周三我给团队的 Claude Code 升级底层模型到 claude-sonnet-5,MCP Server 配起来只花了 15 分钟——但之后 subagents 死活不执行 tool call,不报错、不超时

#前端#javascript#开发语言 +1
gpt-5.5、deepseek-v4-pro、claude-opus-4.8 跑同一套 50 道编程题——有一类任务结果和官方榜单完全反过来

GPT-5.5 上线后,我花了一整晚把手头积攒的 50 道编程测试题跑了一遍。。结论先放这儿:算法题 GPT-5.5 确实猛,但工程级 debug 场景 Claude Opus 4.8 依然是王;DeepSeek V4 Pro 在"读懂已有代码并补全"这件事上被严重低估了——在各家发布会公布的 HumanEval 等 benchmark 排名(非独立第三方评测,仅供参考)上靠后的模型,在我自己的工

#AI
说实话,deepseek-v4-pro 写代码比 qwen3.7-max 猛——但我拿 glm-5.1 跑了 45 道真实任务,有一类重构题结果让我没想到

说实话,deepseek-v4-pro 写代码比 qwen3.7-max 猛——但我拿 glm-5.1 跑了 45 道真实任务,有一类重构题结果让我没想到上个月团队在做技术选型,要给内部的 Code Review 工具接一个代码生成/重构的后端。我花了差不多一周时间,拿glm-5.1三个模型跑了 45 道真实编程任务。结论先放这儿:算法题 deepseek-v4-pro 碾压,业务逻辑 qwen3

#重构#AI
kimi-k3 官网挤爆了怎么办?通过 ofox API 绕开排队的完整教程——两处关键参数和 kimi-k2.7-code 不一样,填错会静默截断

上周三 Moonshot 官网限制新用户订阅的消息一出来,我手头一个长文档摘要项目直接卡住了——排队页面刷了二十分钟没动静。后来换到的聚合网关,改了个 base_url,10 分钟跑通。但这里有个坑:从 kimi-k2.7-code 迁移到 kimi-k3 有两处关键参数不一样(model_id 格式、max_tokens 上限),其中 max_tokens 填错不会报错,只会静默截断你的长上下文

#java#数据库#服务器
    共 54 条
  • 1
  • 2
  • 3
  • 6
  • 请选择