#3787·axolotl量化 MoE 的专家级分层 CPU 卸载: 30B-A3B QLoRA 约为 7 GB (单个驻留专家层,延伸了层卸载思想)作者: pjordanandrsn创建于 2026年7月2日更新于 2026年7月19日标签waiting for reporter使用案例 内容来源: axolotl-ai-cloud/axolotl查看 GitHub 原文在 GitHub 查看讨论