最近用了几款大模型开展开发工作,我察觉到一个很有意思的规律:当业务代码逻辑稍微复杂之后,倘若直接在原有对话会话中,让刚刚写完代码的 AI 自查漏洞,它大多会判定代码不存在 Bug 。
可只要新建一个空白会话重新提交代码进行审查,AI 往往便能找出各类问题;若是再更换一款大模型检测,排查出的细节问题还会更多,只是其中相当一部分属于影响不大的次要瑕疵。
这是不是 AI 之间的相互挑刺?
可只要新建一个空白会话重新提交代码进行审查,AI 往往便能找出各类问题;若是再更换一款大模型检测,排查出的细节问题还会更多,只是其中相当一部分属于影响不大的次要瑕疵。
这是不是 AI 之间的相互挑刺?