#3718·peft在 8 个 B200 上使用 FSDP 训练 Qwen3.8-27B LoRA 时,在没有示例/sft 的情况下默默地降低 delta 规则回退速度作者: TarzanZhao创建于 2026年9月11日更新于 2026年9月16日系统信息 内容来源: huggingface/peft查看 GitHub 原文在 GitHub 查看讨论