传递给 `TimesFM3Forecaster.from_pretrained` 的 `use_variate_attention=False` 将被默默忽略
作者: charlieyanhx创建于 2026年9月8日更新于 2026年9月8日
通过 `TimesFM3Forecaster.from_pretrained("google/timesfm-3.0-pytorch", device=..., use_variate_attention=False)` 传递 `use_variate_attention=False` 会生成一个模型,其输出与默认值完全相同(在多变量输入中,最大 |diff| 精确为 0.0,约 390 万个点和量位值; timesfm 3.0.0, torch 2.13):该关键字进入构造函数路径,但该标志在模块构建时被消耗,加载的架构没有变化。在向前推进时设置属性后加载(`fc.model.use_variate_attention = False`)也是一个无效操作。在抽象研究中,无论是尊重关键字(重建/绕过多变量注意力块)还是在 `from_pretrained` 中提示不支持的架构覆盖 - 无声的无效操作在抽象研究中是危险的,因为两种配置 *预期* 会不同,相同的结果可能会掩盖为一个发现。我很乐意提供一个最小的重现脚本。
内容来源: google-research/timesfm