百科.dev
全部条目AI 编程趋势榜开源项目技术资讯提交条目
登录
返回工具页

colibri · Issues· 143 开放

在 GitHub 打开

本地同步的开放议题(评论请到 GitHub 查看)

  • #1601

    coli 服务: RAM 自动检测返回 0.0 GB,并默默地回滚到一个极小的专家缓存(无警告)

    更新于 2026年9月18日
  • #1600

    coli run: 非 glm 引擎的 SNAP env var 从未设置 (olmoe 已经确认) — 总是会出现 '没有模型启动' 的错误

    更新于 2026年9月18日
  • #1464

    [Bug]: RTX 3080 sm 86, WSL2 - 在每个提示上"Hybrid分批块在MOE中失败"

    更新于 2026年9月18日
  • #1594

    [错误]: Qwen 3.8 闪存下一页太慢

    更新于 2026年9月17日
  • #1306

    Qwen3.8-Flash-Next: qwen38 引擎是否计划支持 GPU 后端 (CUDA/HIP)? (优惠: gfx1151/ROCm 7.2.4 验证和基准测试)

    更新于 2026年9月17日
  • #1593

    [错误]: 医生报告"没有张量可以执行这些核心角色: 标记嵌入、输出头"对于一个健康的 DeepSeek V4 容器

    更新于 2026年9月17日
  • #1592

    [功能]: 我如何运行 Maxmini 2.7

    更新于 2026年9月17日
  • #1581

    [错误]: Linux, 兄弟引擎: `--auto-tier` 会默默地删除 `coli plan`/`coli doctor` 所宣传的 VRAM 层 (qwen36 CUDA 构建, 11.8 → 21 tok/s 使用 `--gpu auto`)

    更新于 2026年9月17日
  • #1576

    glm53: 在 bare tool-call 转换后丢失 KV 前缀重用 — 模板写入 "\n<tool_call>", 模型不支持

    更新于 2026年9月17日
  • #1570

    Vulkan 永远不会被拆除: 没有引擎调用 coli_vk_shutdown (Metal 是如此,在 kimi_k3 中)

    更新于 2026年9月17日
  • #1577

    [错误]: Windows 上的 qwen36 CUDA_DLL: 除非设置了 COLI_GPUS (在加载 DLL 之前查询可用设备数量),否则层级将选择 0 个设备

    更新于 2026年9月17日
  • #1370

    Perplexity 与 Ollama's Q4_K_M 在相同的令牌上进行比赛: 我们的 int4 专家损失了 2.5% 至 3.4%, int8 树干没有购买任何东西 — 这两个问题都与格式有关

    更新于 2026年9月16日
  • #1498

    [错误]: GPU 未启动

    更新于 2026年9月16日
  • #1550

    [功能]:添加深色模式开关按钮

    更新于 2026年9月16日
  • #1538

    DeepSeek V4: GB10 上的 GPU 输出(sm_121,统一内存)来自路由专家 VRAM 镜像缓存

    更新于 2026年9月15日