colibri · Issues· 143 开放
在 GitHub 打开本地同步的开放议题(评论请到 GitHub 查看)
- #1601
coli 服务: RAM 自动检测返回 0.0 GB,并默默地回滚到一个极小的专家缓存(无警告)
更新于 2026年9月18日 - #1600
coli run: 非 glm 引擎的 SNAP env var 从未设置 (olmoe 已经确认) — 总是会出现 '没有模型启动' 的错误
更新于 2026年9月18日 - #1464
[Bug]: RTX 3080 sm 86, WSL2 - 在每个提示上"Hybrid分批块在MOE中失败"
更新于 2026年9月18日 - #1594
[错误]: Qwen 3.8 闪存下一页太慢
更新于 2026年9月17日 - #1306
Qwen3.8-Flash-Next: qwen38 引擎是否计划支持 GPU 后端 (CUDA/HIP)? (优惠: gfx1151/ROCm 7.2.4 验证和基准测试)
更新于 2026年9月17日 - #1593
[错误]: 医生报告"没有张量可以执行这些核心角色: 标记嵌入、输出头"对于一个健康的 DeepSeek V4 容器
更新于 2026年9月17日 - #1592
[功能]: 我如何运行 Maxmini 2.7
更新于 2026年9月17日 - #1581
[错误]: Linux, 兄弟引擎: `--auto-tier` 会默默地删除 `coli plan`/`coli doctor` 所宣传的 VRAM 层 (qwen36 CUDA 构建, 11.8 → 21 tok/s 使用 `--gpu auto`)
更新于 2026年9月17日 - #1576
glm53: 在 bare tool-call 转换后丢失 KV 前缀重用 — 模板写入 "\n<tool_call>", 模型不支持
更新于 2026年9月17日 - #1570
Vulkan 永远不会被拆除: 没有引擎调用 coli_vk_shutdown (Metal 是如此,在 kimi_k3 中)
更新于 2026年9月17日 - #1577
[错误]: Windows 上的 qwen36 CUDA_DLL: 除非设置了 COLI_GPUS (在加载 DLL 之前查询可用设备数量),否则层级将选择 0 个设备
更新于 2026年9月17日 - #1370
Perplexity 与 Ollama's Q4_K_M 在相同的令牌上进行比赛: 我们的 int4 专家损失了 2.5% 至 3.4%, int8 树干没有购买任何东西 — 这两个问题都与格式有关
更新于 2026年9月16日 - #1498
[错误]: GPU 未启动
更新于 2026年9月16日 - #1550
[功能]:添加深色模式开关按钮
更新于 2026年9月16日 - #1538
DeepSeek V4: GB10 上的 GPU 输出(sm_121,统一内存)来自路由专家 VRAM 镜像缓存
更新于 2026年9月15日