别被“大模型”三个字吓住,换个思路,它就是一个刚入职的实习生

大家好,我是某互联网公司的测试架构师。

这两年,我身边越来越多测试同行在焦虑一件事:“大模型到底怎么用?我看别人用得挺好,我自己一用就翻车。”

我每次的回答都一样——别把大模型想得太复杂。你就当团队里来了个实习生,瞬间就知道该怎么跟它打交道了。

一、为什么“实习生”这个比喻最贴切?

大模型和实习生有三个极其相似的特点:

第一,知识面广,但没经验。 实习生刚从学校出来,什么理论都学过,但落到具体业务上,两眼一抹黑。大模型也一样——它知道“等价类划分”是什么,但不知道你们公司的优惠券规则有多变态。

第二,你问得越清楚,它做得越好。 你跟实习生说“把这个需求测一下”,他大概率不知道从哪下手。你跟他说“打开这个页面,输入这三个值,检查结果是不是0”,他立刻就能干。大模型完全一样。

第三,它需要“带”。 实习生不会因为你说了一次就永远记住所有规则,他需要你反复教、给反馈、纠偏。大模型也是——你需要在对话里不断纠正,它才会越来越准。

一旦接受了这个设定,大模型的所有“缺点”都变得可以理解了。

二、把大模型当实习生,六个核心用法

用法一:给具体任务,别给模糊目标

❌ 错误示范:“帮我测一下这个功能。”

实习生会一脸茫然:“测什么?怎么测?测到什么程度算完?”

大模型也一样。你给它一句“帮我测一下”,它只能猜,猜出来的结果大概率不是你要的。

✅ 正确示范:“帮我把这个登录功能写一个测试用例。输入正确的账号密码,检查登录成功后页面右上角是否显示用户名。”

实习生立刻知道该干什么了,大模型也一样。

记住:你给的信息越具体,产出就越接近你想要的。 这不是AI的问题,这是所有“新员工”的共同特征。

用法二:给它“标准答案”学习

实习生第一次写用例,格式肯定不规范。你怎么办?给他一个模板——“照着这个格式写。”

大模型也一样。想让AI按你公司的格式输出报告,先给一个历史报告作为示例,告诉它“就按这个格式写”。给完之后,效果立竿见影。

这个叫Few-shot,但你就当它是“给实习生看个样例”。

有测试同事实测后反馈:用这种方法,用例生成效率至少能省60%-70%的时间

用法三:分步骤交代,别一口气全倒给它

实习生记不住太长的指令。你跟他说“去写用例、执行、出报告、整理Bug”,他大概率做着做着就忘了后面还有步骤。

大模型也一样。上下文一长,它会“遗忘”前面的信息,导致输出质量下降。

✅ 正确的做法是分步骤:

  1. 先让它分析需求文档,提取测试点

  2. 再基于测试点生成用例

  3. 最后让它整理成表格

每步确认完了再进行下一步,效果比一次性全丢给它好得多。

用法四:它会犯错,你要会纠偏

实习生第一次跑测试,可能漏了边界值、忘了检查异常场景。你不会因此开除他,你会告诉他“这里漏了,下次注意”。

大模型犯错的时候也是一样。 别因为它一次输出不对就放弃,纠正它、引导它,它会越做越好。

比如AI生成的用例漏了“密码错误”这个场景,你只需要加一句:“补充一下密码错误的情况。”它立刻就会补上。

你不需要会写代码,你只需要会“看”和“说”。

用法五:你说人话就行,不用学“AI语言”

很多测试同行第一次用大模型,总觉得要“专业一点”,于是写一些自己都不太懂的术语,结果AI给出来的东西也云里雾里。

根本不用这样。你用自然语言说人话就行——“登录页面的账号和密码校验,帮我写几个测试场景”——这个表述就完全够用了。

大模型的理解能力远超你的想象,你说得越像“对同事说话”,它越能理解你。

用法六:它会“摸鱼”,你得验收

实习生干完活,你不能默认“他一定干对了”,你得检查。

大模型生成的用例,你必须审核。它可能:

  • 漏掉了隐含的业务规则

  • 断言写错了

  • 覆盖了错误的方向

审核AI的产出,比从零开始写,工作量小多了,但不能省略。

三、一个真实案例:我是怎么“带实习生”的

前几天,我需要验证一个订单系统的退款流程,涉及多步骤操作。我直接在对话框里给了这样一段话:

“帮我生成一个测试用例。测试场景:用户已支付订单,申请全额退款。操作步骤:

  1. 打开订单详情页

  2. 点击‘申请退款’

  3. 选择‘全额退款’并填写原因

  4. 提交

  5. 检查订单状态变为‘退款中’

  6. 模拟后台审核通过

  7. 检查订单状态变为‘已退款’

  8. 检查用户账户余额是否增加对应金额

要求覆盖正常流程、退款被驳回、部分退款等场景。

输出格式:表格,列包括用例编号、测试场景、前置条件、测试步骤、预期结果。”

AI几秒钟就给我输出了一张完整的表格——正常流程、驳回场景、部分退款、退款超时、金额不匹配……你想到的和没想到的,它都覆盖了

第一次生成的用例还缺了“退款失败重试”的场景,我补了一句:“补充退款失败后重试的场景。”它又给我补了两条。

整个过程下来,我写提示词不到10分钟,AI生成加我审核补充不到半小时,产出了大概50多条核心用例。放到以前,这个量级的用例我一个人要写两天。

四、大模型做不到的事(你就当实习生办不到)

搞清楚它能做什么,也得搞清楚它做不了什么。

第一,它不懂你们公司的“潜规则”。 业务逻辑中的隐含规则——某些特殊用户的特殊待遇、某些历史原因导致的奇葩逻辑——这些需要人工补充。实习生也不知道这些,你得告诉他。

第二,它不会质疑需求。 需求文档说“这个按钮要放在这里”,AI不会说“放这里用户可能找不到”。因为它没有业务Sense。实习生也很少敢质疑老员工的需求。

第三,它不承担责任。 AI生成的用例出了问题,最终责任还是你的。实习生出了错,最终兜底的也是你。你永远是那个“签字的人”。

五、给测试同行的几点建议

第一,忘掉“提示词工程”这个词。 对测试来说,它不是什么高深的技术,就是“怎么跟新人交代工作”。你说清楚要什么、给个样例、分步骤说、做完了检查——这套东西你早就会了。

第二,把你平时交代工作的语言直接拿来用。 不需要学什么特殊语法,你的日常表达就是最好的提示词。

第三,先从一个具体的小任务开始。 别一上来就让AI“测整个系统”。让它先写一个登录功能的用例,再逐步扩展——就像你带实习生,也是先从小任务开始。

最后

大模型没那么神秘。它就是那个刚入职、什么都会一点但什么都不精的实习生。

你不能指望它自己搞定一切,但有了它,你可以把时间花在真正需要你判断的事情上。

下次打开大模型对话窗口的时候,别想“我在跟AI对话”,想“我在给实习生交代工作”。

瞬间就知道该怎么用了。

更多推荐