一篇最新论文提出了一种名为"对抗式审查"的规则,用于提升AI智能体的代码审查能力。核心要求很简单:审查者与批评者必须用代码证据回应分歧,而不是简单互相认同。
规则奏效的关键在于"结构化分歧"。当智能体之间出现不同意见时,必须拿出具体的代码依据来支撑自己的判断,这迫使讨论停留在事实层面,而非流于形式上的附和。
![]()
效果在测试中相当直观。在LiveCodeBench基准上,采用该规则的3个智能体组合达到了87%的准确率,反而优于5个智能体版本的82%。智能体数量减少,准确率却更高,说明分歧质量比参与数量更重要。
在真实PR审查场景中,这一规则同样表现突出。引入对抗式审查后,F1分数从0.457提升至0.533,直接跃居首位。
这套方法给AI协作提供了一个新思路:与其追求意见一致,不如设计规则让分歧变得有建设性。对开发者而言,这意味着未来AI代码审查工具可能不再只是"人多力量大",而是更讲究如何组织讨论。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.