百科.dev
全部条目AI 编程趋势榜开源项目技术资讯提交条目
登录
返回工具页

ART · Issues· 143 开放

在 GitHub 打开

本地同步的开放议题(评论请到 GitHub 查看)

  • #902

    调查匹配的同源 Qwen TrainerRank 角色之间的输出和梯度变化

    更新于 2026年9月17日
  • #870

    TrainerRank 可重用缓存的使用可能会导致后向库分配时物理 CUDA 内存不足

    更新于 2026年9月17日
  • #848

    TrainerRank MoE 内存接收: 后向重新计算 OOM 和配置校准失败

    更新于 2026年9月17日
  • #917

    在 TrainerRank 中支持专家和数据并行

    更新于 2026年9月16日
  • #916

    在 TrainerRank 中支持管道并行,而不向调用者暴露阶段调度

    更新于 2026年9月16日
  • #901

    在独立请求共同封装时调查大型隐藏状态差异 (Qwen3.6, no-grad)

    更新于 2026年9月15日
  • #883

    保留的采样后缀可以在不同的因果前缀下携带 logprobs

    更新于 2026年9月11日
  • #869

    通过执行布局确定是否需要或可避免大型动力学 RL 批量拒绝

    更新于 2026年9月11日
  • #364

    特点:支持 GRPO 博士

    enhancement更新于 2026年9月4日
  • #851

    Qwen3.5-35B-A3B 在 EP1 上在 Transformer 引擎的分组 GEMM 中出现了 CP>1 的段错误,发生在真实数据路由中(可能是空的本地专家)

    更新于 2026年9月4日
  • #678

    在 LoRA 适配器重新加载期间,专用本地后端 vLLM 服务器可能无法访问

    更新于 2026年7月27日
  • #672

    回归:分支 GRPO 运行可能在较新的 ART 环境中生成格式不正确的检查点输出

    bug更新于 2026年5月8日
  • #661

    在使用 LocalBackend 时,LoRA 适配器无法正常同步 - 部署中使用了过时的适配器

    更新于 2026年4月24日
  • #651

    LocalBackend fork_checkpoint 未更新 vLLM 的初始 LoRA

    更新于 2026年4月13日
  • #649

    将 from_entity 参数添加到 _experimental_fork_checkpoint

    更新于 2026年4月10日