Llama-Chinese · Issues· 195 开放
在 GitHub 打开本地同步的开放议题(评论请到 GitHub 查看)
- #56
安装依赖时出现错误,在爬取过程中
更新于 2025年5月30日 - #368
调整后的模型如何在本地部署
更新于 2025年4月28日 - #290
出错:需要下列参数: 用户 script, 用户 args
更新于 2025年3月27日 - #369
虚拟环境安装 deepspeed 依赖报错和其他冲突问题的一种解决方案
更新于 2025年3月1日 - #299
LLaMA-2-13b 多卡推理报错 RuntimeError: CUDA 错误: 触发了设备端断言 请使用 `TORCH_USE_CUDA_DSA` 编译,以启用设备端断言。
更新于 2025年2月20日 - #338
本地部署 LLaMA 3 70B,进行微调和推理,需要的硬件配置
更新于 2025年2月18日 - #330
Llama3 8B 中文微调模型 Llama3-Chinese-8B-Instruct 存在生成答案一直重复的问题
更新于 2025年2月2日 - #367
httpx.ConnectError: 在违反协议的情况下出现 EOF (_ssl.c:1002)
更新于 2025年1月16日 - #248
API部署出错
更新于 2024年12月9日 - #366
拉玛3-8b-中文
更新于 2024年11月21日 - #314
有 vllm chat-template 吗
更新于 2024年11月20日 - #365
在使用 Ollama 本地部署的 Llama3 模型生成 xml 格式的脚本时,突然停止了输出,是否超出了输出限制?但有时却能完整输出,只是后面的结果不太准确。
更新于 2024年11月5日 - #312
pretrain.sh 中的预训练样本数据未提供
更新于 2024年10月17日 - #363
我使用你们提供的 Llama3 中文版本推理速度非常慢
更新于 2024年9月24日 - #362
社区在线体验推理与直接部署模型推理结果不一致
更新于 2024年9月20日