百科.dev
全部条目AI 编程趋势榜开源项目技术资讯提交条目
登录
返回工具页/返回 Issues 列表
#2897·flash-attention

[CuTe, SM80] 前向模型默认忽略 `block_sparse_tensors` 并返回稠密注意力

作者: nien-hui创建于 2026年9月18日更新于 2026年9月18日

问题

内容来源: Dao-AILab/flash-attention

查看 GitHub 原文在 GitHub 查看讨论