对 PallasTritonGatedLinearUnit 进行自动调优缓存未命中,推理时间显著增加。

作者: Maikuraky创建于 2026年9月14日更新于 2026年9月14日

更新到最新版本的代码后,在使用 RTX A6000 运行时,我注意到以下警告: `Autotuning cache miss for PallasTritonGatedLinearUnit(config=None, vjp=GatedLinearUnitVjp(config=None, vjp=None)) on NVIDIA RTX A6000 with key immutabledict.` 此外,对于长度为 898 个氨基酸的蛋白质,单个种子的 GPU 推理时间比 V3.0.1 版本长至少 80 秒。

内容来源: google-deepmind/alphafold3