
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
自动化测试最大的谎言,是脚本跑通就等于测过。很多脚本之所以跑通还漏bug,就是因为断言没写到位——要么漏了关键字段,要么断言得太浅。以前这事儿靠人盯,靠经验,靠Code Review。现在多了一个帮手——AI。它不会替你思考业务逻辑,但它能帮你把想到的、该断言的,一个不漏地写下来。而且写得比你快、比你准。今天的我,下午四点收工去接孩子。明天开始教老王。等他也学会了,我们就能一起研究下一件事:怎么让
GLM-5 的价值,并不仅体现在参数规模或排行榜位置。真正值得关注的是:推理成本结构的改变Agent 决策稳定性的提升国产算力生态的工程适配当模型开始具备稳定的代理编程能力,它会逐步进入自动化体系核心。对从业者而言,关键问题不是模型有多强,而是:你的自动化与测试体系,是否准备好适配这种能力结构的变化。大模型的升级,往往意味着工程范式的调整。
从零到跑通第一个智能体,其实没那么难对吧?我当初卡在Python版本问题上整整两天,就是没人告诉我3.12不行。希望这篇教程帮你避开了我踩过的那些坑。OpenClaw能做的事情远不止查天气,你可以让它帮你处理文档、写代码、分析数据……等你熟悉了基本用法,会发现这东西的想象力空间挺大的。有什么问题欢迎在评论区留言,我看到就会回。下一篇我打算写怎么给智能体加上网页界面,让不是程序员的人也能用。想看的可
历史上每一次技术革命都会发生同样的事情:工具升级 → 工作方式升级 → 职业能力升级。AI 也是如此。构建 AI。如果你只是使用 AI,很快会被替代。搭建 AI 测试系统。那就是完全不同的职业天花板。
更糟糕的是,像 Claude Code 这样,客户端可以单方面改变缓存策略,用户完全不知情。你看不到真实的思考深度(被 redact 了),看不到缓存是否命中(被静默降级了),看不到工具结果是否被截断(截断了也不告诉你)。当 Anthropic 在“追求极致体验”与“沉重推理成本”之间剧烈挣扎时,开发者需要的不是一个替自己做决策的黑盒,而是一个透明、可预测的杠杆。当 AI 工具开始在用户看不见的地
最近大家关注这些 AI 更新,很多人看到的是模型更强了、工具更多了、场景更热闹了。但站在测试的角度,真正值得重视的不是热闹,而是边界变化。当 AI 开始走进桌面、走进办公流程、走进企业系统,测试面对的就不再只是“它答得对不对”,而是:它会不会做错事它做事能不能做完整它出错后能不能恢复它在真实环境里能不能长期稳定运行这也是为什么我一直觉得,接下来真正有价值的测试能力,不会只是会写自动化脚本,也不会只
这类 JetBrains 插件真正值得关注的,不是“AI 终于会写代码了”。AI 辅助编码,开始进入 IDE 内的工程闭环阶段。对很多开发者来说,Claude Code 之前更像一个强大的命令行助手;而像 CC GUI 这样的工具,正在把它往“IDE 内持续协作的工程伙伴”方向推。侧边栏对话、@file上下文、图片输入、Diff 比对、历史会话、Agent、MCP,这些能力放在一起之后,AI 就不
AI 应用很容易把大家的注意力吸引到模型能力本身。但真正进业务后,很多问题最后并不出在模型,而是出在底层工程能力。比如存储、缓存、回收、长稳运行、吞吐、资源利用率、异常恢复,这些听起来更像传统工程问题,但在 AI 应用里同样关键。尤其是知识库、智能体平台、多步骤任务系统、模型服务平台,一旦数据量、调用频率和业务复杂度上来,底层问题会被放大得非常快。有些系统离线演示时看起来没问题,但一上线上量就开始
最近 WorkBuddy 讨论度很高,本质上它代表的是一类新的桌面 AI Agent: 不只是和 AI 对话,而是让 AI 理解任务、调用模型、连接 Skills / 插件、读取知识库,并进一步操作本地文件、表格、浏览器和办公流程。 这类产品真正值得关注的点,不是“又多了一个聊天助手”,而是 AI 正在从问答工具,逐渐变成能参与真实工作的执行型助手。 这组图带你快速看懂: WorkBuddy 是什
很多同学以为:👉 “春招结束 = 没机会了”但真实情况是:👉 机会还在,只是变成了“补录机会”。而补录的本质是:更隐蔽更随机但相对更容易进。







