#2581·flash-attention在 SM89 (Ada) 上支持 head_dim=512,用于 Gemma 4 全局注意力层作者: ShuaiShao93创建于 2026年5月21日更新于 2026年9月9日功能请求 内容来源: Dao-AILab/flash-attention查看 GitHub 原文在 GitHub 查看讨论