omlx · Issues· 1372 开放
在 GitHub 打开本地同步的开放议题(评论请到 GitHub 查看)
- #3729
为 xing4_0 (XingChen-AGI/Xing4.0-29B-A4B) 添加 mlx-lm 架构支持 — oQ 失败,出现"敏感度测量未生成分数"错误
更新于 2026年9月18日 - #3727
支持 Prism ML Hadamard 包 (三元 Bonsai 2 27B、MLX 2 位): 将数据发送到包中的捆绑加载器,并注册其 MODEL_CONFIG 格式
更新于 2026年9月18日 - #3697
mlx-lm/mlx-vlm 是否可以保持最新?
更新于 2026年9月18日 - #3725
下载器页面显示的模型文件大小不正确
更新于 2026年9月18日 - #3704
损坏缓存管理
更新于 2026年9月18日 - #3723
在 qwen4_exp (M3 Ultra) 上,服务器正常运行时间使解码吞吐量下降了约 3.2 倍:在运行约 10 小时后为 20.5 tok/s,而新进程为 66.5 tok/s
更新于 2026年9月18日 - #1970
当内存只适合处理一个模型时,并发跨模型请求处理会中断
更新于 2026年9月17日 - #3716
为每个 2 位检查点安装了 Bonsai/t5 加载补丁,且没有测试覆盖该路径
更新于 2026年9月17日 - #1835
macOS 27: 长上下文推理比 macOS 26.6 慢 10 倍(即使在修复 HOST_VM_INFO64 后也是如此)
更新于 2026年9月17日 - #3706
macOS 27: 定期清除 Metal 缓存时会触发 kIOGPUCommandBufferCallbackErrorTimeout,然后引擎无法自行恢复 (0.5.7, M3 Ultra)
更新于 2026年9月17日 - #3709
PDF 处理引擎无法运行
更新于 2026年9月17日 - #3699
SSD 前缀缓存在 qwen4_exp 混合模式下永远不存储: 当边界快照启用时, available_boundaries=0
更新于 2026年9月17日 - #3690
TurboQuant KV 缓存 (4 位) 会在命中前缀缓存的请求中默默地损坏详细信息的检索
更新于 2026年9月17日 - #3707
[功能请求] 适用于推理工作负载的原生 macOS 菜单栏可观察性
更新于 2026年9月16日 - #2029
服务器死机,显示"[METAL] 命令缓冲区执行失败: 导致 GPU 超时错误"
更新于 2026年9月16日