前言 codex 代码审计:

        这几天正好有空,想起不久前搭建好的本地ollama qwen3.6环境,便想让Codex帮忙审计下代码。顺便也测试下自己的代码质量:运行过程中意外发现了一些有趣的现象。

ollama qwen3.6

        最初我使用的是本地部署的Qwen3.6模型。在实际使用过程中,确实发现它能帮我找出一些容易忽略的问题,比如单词拼写错误或逻辑漏洞等。但随着对话轮次增加,可能是由于本地运行的限制,当上下文较长时,模型就开始出现逻辑混乱的情况。于是,我决定尝试运行智谱的GLM-5.2模型进行对比测试。

glm-5.2

        glm5.2 给我挺惊讶的, 一个项目跑下来 指出了很多问题。应为有些问题 的确不会引起容易被察觉的问题。一连串帮我揪出很多小问题:

 

有时候可能应为上下文的关系,或者他自己钻的不够深度:也会有一些问题。和他交互下就行

总结

        之前还是有些抵制 AI 写代码的,只是作为 工具查询问题。下一步 试试让AI 项目。然后给他立规矩 尝试尝试

更多推荐