logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

把这 3 个测试 Skill 装进 OpenClaw:本地目录、安装、验证与排错

这篇继续往下走,不再讲“为什么要做 Skill”,而是讲:怎么把这 3 个测试 Skill 放进 OpenClaw 的本地工作区,并完成一轮验证。目标不是一次性做成完美 Skill,而是先完成一个最小可用版本。

#人工智能
Claude Code 搜索失效?用 MCP 一行命令接入 Tavily,比内置还好用

问题原因解决方案WebSearch 返回 0 结果后端搜索服务在特定环境下不可用接入 Tavily MCP Server 替代上下文压缩后跑偏关键上下文丢失,AI 沿有察觉偏题写入自检纪律到 memory内置能力是黑盒就绕过它,用 MCP 接入可控的替代方案。这不只是搜索问题的解法,也是 Claude Code 扩展能力的通用模式——MCP 让你用最好的工具替代不够好的内置工具。

AI Agent 的「省 token 神器」:Headroom 压缩实测

产品Token 优化思路有后处理压缩?有专用压缩模型?HeadroomML 模型 + 结构化 + 代理✅Prompt caching + 对话摘要❌❌CodexPrompt caching + 子代理隔离❌❌Cursor语义检索 + 自有模型❌❌CopilotEmbedding 语义搜索❌❌Agent 看到太多无用信息,浪费 token。不无脑压缩——ContentRouter 区分 6+ 种内容

#人工智能
为什么 AI 会一本正经地胡说八道?测试工程师需要懂一点 Transformer

总结 PRD总结会议纪要总结制度文档总结项目报告总结故障复盘总结看起来很完整;语言也很顺;结构也没问题;但关键规则漏了。比如需求文档里写:报销金额超过 5000 元需直属上级审批,超过 20000 元还需财务复审。AI 总结成:系统会根据报销金额走不同审批流程。这句话不能说完全错,但对业务几乎不够用。5000 元;20000 元;对应审批角色。为什么长文档总结容易这样?因为“能把长文档放进模型上下

#人工智能#transformer#深度学习
Hermes Agent 实测:有记忆、有技能、能并发的 CLI Agent 到底好不好用

放在,每次会话自动加载。和 Claude Code 的 CLAUDE.md 类似,但 SOUL.md 管人格,AGENTS.md 管项目指令,分得更清楚。

#pytest#测试
ClaudeCode_测试Ontology_MCP实战

这一步的重点不是建数据库,而是先把测试工作中的关键对象和关系显式表达出来。我们先定义5 类对象:Requirement、Release、Module、TestCase、Bug。对象含义示例需求报销审批规则优化Release版本REL-1.2.0Module模块H5端、数据导出、报销审批TestCase测试用例H5端提交报销后状态变为审批中Bug缺陷H5端提交报销后状态未刷新关系含义版本包含需求需求

AI Agent 的「代码地图」:codebase-memory-mcp 如何让 Agent 秒懂你的代码库

AI Agent 不知道怎么「看懂」一个代码库。把代码变成图谱,把图谱通过 MCP 提供给 Agent。快:毫秒级查询,3 分钟索引 Linux 内核省:99% token 节省,2.1x 更少工具调用简:单文件二进制,零依赖,一行安装通:158 语言,11 个主流 Agent 自动适配对于日常使用 AI Agent 做开发的工程师来说,这是一个「装了就回不去」的工具。

#人工智能#数据库
Claude Gateway 排查教程

网络是否可达路径是否正确鉴权是否通过是否支持 Anthropic Messages API非流式是否有真实内容流式 SSE 是否正常system prompt 是否兼容模型上下文窗口是否足够当 Claude 卡在时,不要只在前端反复点击Try again。先用脚本把 Gateway 打穿一遍,基本就能判断问题是在前端、网关、模型路由,还是上下文窗口。是 Claude 第三方 Gateway 接入的

#人工智能#网络#数据库
Claude Cowork、Codex、OpenClaw、Hermes 怎么选?一篇看懂四类 AI Agent 的差异

Claude Cowork 像办公代理,Codex 像研发代理,OpenClaw 像个人助理平台,Hermes 像会成长的 Agent 系统。我现在最想让 AI 替我完成哪类工作?这个问题答对了,工具基本就选对了一半。

#人工智能
OpenClaw 装好了,然后呢?我用它跑了一次完整测试分析流程

经过自检后,正式用例可以分成三类。问题;测试点;用例;自检结论。哪些规则已经明确;哪些问题必须评审确认;哪些用例能入库;哪些预期不可验证;哪些内容只是 AI 的合理猜测。这不是 OpenClaw 的缺点,而是 AI 测试工作流必须保留的人为把关。这次实操让我更明确一件事:AI 工具真正进入测试工作,不是靠一句“帮我生成测试用例”。先问问题再拆测试点再收敛范围再筛选入库再生成用例最后做自检每一步都让

#网络#服务器#运维
    共 54 条
  • 1
  • 2
  • 3
  • 6
  • 请选择