#1355·ChatGLM3请问在微调 chatglm3 之后, 如何使用 vllm 进行推理加速, 我无法使用 vllm 加载微调后的模型作者: ZY-LUCK创建于 2025年3月19日更新于 2025年3月19日—内容来源: zai-org/ChatGLM3查看 GitHub 原文在 GitHub 查看讨论