litgpt · Issues· 290 开放
在 GitHub 打开本地同步的开放议题(评论请到 GitHub 查看)
- #2223
在 Google Colab 中进行预训练时没有保存任何检查点,尽管已设置 log.log_model 和 save_interval。
bug更新于 2026年9月8日 - #2323
在采样概率为 float16 时,LLM.generate() 可以在 CPU 上默默地选择被 top_k 排除的令牌
更新于 2026年9月8日 - #1242
`merge_lora.py` 中关于混合精度的假阳性警告
更新于 2026年9月7日 - #2306
Reang
question更新于 2026年9月4日 - #2319
当某个 rank 的 val_dataloader 返回零个批次时,litgpt pretrain 会崩溃或陷入死锁(多 GPU FSDP)
更新于 2026年9月4日 - #1102
使 `save_hyperparameters()` 具备对不同 CLI 入口点的鲁棒性
bughelp wanted更新于 2026年8月30日 - #2307
推测性解码会丢弃第一个生成的令牌
更新于 2026年8月25日 - #2302
停止序列匹配会处理不当重叠前缀和缓冲的标记
更新于 2026年8月19日 - #2189
不安全的检查点加载 - 这是不好的
更新于 2026年7月21日 - #2158
支持 SSM 模型 (Mamba、Mamba2)
enhancement更新于 2026年7月20日 - #2116
`finetune` 脚本中的初始和最终评估不会在设备之间累积
bug更新于 2026年6月13日 - #1871
将预训练的 litgpt 检查点转换为 HF 格式失败: 可重现的示例
bughelp wanted更新于 2026年6月13日 - #2191
在微调中,渐变裁剪不起作用
question更新于 2026年6月13日 - #1221
计算训练开始和结束时的损失
enhancement更新于 2026年5月23日 - #1082
将 TinyStories 添加到预训练文档中
documentation更新于 2026年5月23日