AI 资讯
新基准测试显示AI难以主动发现代码缺陷
Meta、斯坦福等机构研究者发布SWE-Sweep基准,覆盖100个代码库和4000个真实缺陷。测试显示最佳模型修复率仅4.7%,且成本高达7230美元,主动发现缺陷仍是难题。
阅读全文
分享知识,记录生活
共 1 篇相关文章