gemma.cpp · Issues· 46 开放
在 GitHub 打开本地同步的开放议题(评论请到 GitHub 查看)
- #1036
实验: 对比 RAM 容量大的模型的无损权重调度
更新于 2026年9月22日 - #1002
添加带有可选 QuaRot 风格旋转的实验性 W8A8 MatMul
更新于 2026年9月21日 - #1031
页面大小检查可防止对blob对齐的检查点进行 mmap
更新于 2026年9月15日 - #1029
默认的闪存注意力保留多余的 BF16 KV 投影历史
更新于 2026年9月12日 - #1016
减少局部注意力层的 KV 内存
更新于 2026年9月8日 - #982
添加 SmolLM2 支持 — 是否重用 Qwen3 转换器路径?
更新于 2026年8月27日 - #986
在密集注意力路径上,rope_theta 将被忽略(硬编码为 10000/1000000)
更新于 2026年8月26日 - #990
功能请求/建议:"E12B"(有效 12B) Gemma 5 模型类(针对 12GB VRAM/台式机用户优化)
更新于 2026年8月26日 - #198
Gemma.cpp 在使用 huggingface peft(QLoRA) 微调的 Gemma 7B 模型上卡死
Gemma-7btype:performance更新于 2026年8月20日 - #887
Gemma4 是否由 gemma.cpp 支持?
更新于 2026年7月30日 - #661
T5Gemma 支持
更新于 2026年7月14日 - #888
支持 TranslateGemma 4B 纯文本推理(Gemma 3 4B 仅支持 LM,不支持 VIT)
更新于 2026年5月26日 - #911
为 https://GitHub.com/google/gemma.cpp/blob/main/API_SERVER_README.md 提供一个已知良好的示例
更新于 2026年5月11日 - #885
使用 Emscripten 从 #857 号建筑输出回归结果
更新于 2026年3月26日 - #875
展示/问题:基于 ESP32-C3 的经过实践验证的离线语言运行时,以及这种设计是否指向了更极端的语言/运行时共同设计方式
更新于 2026年3月26日