#1355·ChatGLM3请问 QLora 微调 chatglm3 之后, 如何使用 vllm 进行推理加速, 我无法使用 vllm 加载 QLora 微调后的模型Author: ZY-LUCKCreated Mar 19, 2025Updated Mar 19, 2025—Source: zai-org/ChatGLM3View original on GitHubView discussion on GitHub