百科.dev
全部条目AI 编程趋势榜开源项目技术资讯提交条目
登录
返回工具页

bitsandbytes · Issues· 90 开放

在 GitHub 打开

本地同步的开放议题(评论请到 GitHub 查看)

  • #2087

    [BUG] NF4 Linear4bit 在 gfx1100 上出错 (预构建的 ROCm 6.4 轮); 解量化正确

    更新于 2026年9月15日
  • #2086

    在块大小为 64 时,NF4 重构比 affine int4 表现更差

    更新于 2026年9月11日
  • #2084

    几个测试失败: 未找到固定件 'device'

    更新于 2026年9月11日
  • #2080

    [错误] FSDP1 封装通过扁平分片大小更改了 AdamW8bit 状态精度

    更新于 2026年9月10日
  • #2079

    PytorchLARS.step() 在默认 momentum=0 设置下发生 UnboundLocalError 导致崩溃

    更新于 2026年9月9日
  • #2078

    Params4bit.to() 跳过 .cuda()/.xpu() 所应用的 CPU AVX512 包装逆转,因此 model.to(device) 会默默地损坏权重

    更新于 2026年9月9日
  • #2075

    AdEMAMix32bit 和 PagedAdEMAMix32bit 分配了单个大小的 state1,并在第一步出错

    更新于 2026年9月8日
  • #2011

    提供帮助改进 MPS 后端回退的建议

    更新于 2026年9月4日
  • #2067

    对于包含确切 >= 2^31 个元素的张量,quantize_4bit 会出现"无效配置参数"错误(ops.cu:54)

    更新于 2026年9月3日
  • #2064

    请求了 CPU `gemm_4bit_forward` 内核,但没有指定 `backend="cpu"`,因此在 CUDA torch 构建中永远不会加载

    更新于 2026年8月30日
  • #1261

    8 位优化的错误文档和函数签名

    DocumentationContributions WelcomeOptimizers更新于 2026年8月28日
  • #2047

    CPU dequantize_4bit 即使长度为偶数的 1-D 输入也返回形状 (1, n);其他所有后端返回 (n,)

    更新于 2026年8月20日
  • #2045

    无法量化 nemotron 3.5

    更新于 2026年8月19日
  • #2041

    在 Windows 上, get_gaudi_sw_version() 无限循环 — 模块级子进程运行时使用 shell 管道进行 grep 搜索

    DuplicateWindowsProposing to Close更新于 2026年8月17日
  • #2010

    Adam/AdamW/LAMB/AdEMAMix: 默认和 Triton 后端中,权重衰减的顺序不正确,与 CUDA 内核不一致

    OptimizersCUDA更新于 2026年8月16日