本文(arxiv 2607.24888)值得一站,如果您评估AI代码审查.
它显示肯·汤普森的"信任-信任"攻击并不是针对编译器的:作者们用GNU条来完成它,这种构建工具既不读取,也不生成源,只使用被篡改后完成的ELF二进制.
在"尼克斯斯"(NixOS)"靴子"中,二进制种子中的一个恶意条会将一个有效载荷植入被传播到下一代并活到种子消失后最终标准环境.
任何构建或购买AI评论的不适部分:这些工具读取了补丁文本和出处,没有读取了构建路径或二进制种子.
这不是一个限制 一个更大的模型修复。
把世界上最强的推理模型放在源diff上,它看到一个干净的PR,因为恶意代码完全不在源代码中.
它作为完成的条状二进制在依赖性关闭中到达.
我总是碰到同样的分红 这篇论文是目前最干净的例子 两份工作被打成碎片 一是"这个来源diff引入了bug或缺陷",AI真正,令人惊讶地擅长这个.
另一种说法是"您的用户运行的文物是否与您所审查的来源相匹配",没有基于diff的审核,人或模型,可以回答是.
那是一件文物出处 创造出可复制的工作 不是代码审查的工作 因此,团队通过AI审查的规则:用它来做第一份工作,而不让它的批准让你觉得在第二份工作中被覆盖.
如果你的接受标准变成"模型说diff是好的",你已经将编译器-信任问题交易成脱衣信问题,并称它为"赢".