warp · Issues· 331 开放
在 GitHub 打开本地同步的开放议题(评论请到 GitHub 查看)
- #1980
将循环展开条件减少一项
bug更新于 2026年9月22日 - #1979
Adam 和 SGD 在拒绝短梯度列之前部分更新参数
更新于 2026年9月22日 - #1978
FEM 首次采样插值在三元构造时返回零梯度
bugwarp.fem更新于 2026年9月22日 - #1977
并行化图形所使用内核的编译
feature request更新于 2026年9月21日 - #474
添加对 NCCL 的支持
更新于 2026年9月19日 - #420
[BUG] 调查数组形状和步长不一致的问题
buginterop更新于 2026年9月19日 - #1361
通过直接读取 blockIdx.x 来优化分块 CUDA 启动
tile更新于 2026年9月19日 - #464
添加了更新捕获图形内核参数的功能
feature requestruntime更新于 2026年9月19日 - #1965
tile_matmul(): 使用 cuBLASDx 寄存器累加器 API,并采用针对张量核心精度的建议共享布局
tile更新于 2026年9月18日 - #1837
APIC 可移植到其他设备
feature request更新于 2026年9月17日 - #1972
改进 NumPy 尝试转换 CUDA wp.array 时出现的错误
docs更新于 2026年9月17日 - #937
[REQ] `wp.tile_matmul()` 中的 TF32 计算选项
feature request更新于 2026年9月17日 - #1971
减少 CUDA BSR 转置中的冗余基数排序
warp.sparse更新于 2026年9月17日 - #1970
支持带行压缩的首样 FEM 插值
warp.fem更新于 2026年9月17日 - #1968
@wp.kernel(launch_bounds=...) 在 wp.config.llvm_cuda 下失败
更新于 2026年9月17日