百科.dev
全部条目AI 编程趋势榜开源项目技术资讯提交条目
登录
返回工具页

omlx · Issues· 1372 开放

在 GitHub 打开

本地同步的开放议题(评论请到 GitHub 查看)

  • #3729

    为 xing4_0 (XingChen-AGI/Xing4.0-29B-A4B) 添加 mlx-lm 架构支持 — oQ 失败,出现"敏感度测量未生成分数"错误

    更新于 2026年9月18日
  • #3727

    支持 Prism ML Hadamard 包 (三元 Bonsai 2 27B、MLX 2 位): 将数据发送到包中的捆绑加载器,并注册其 MODEL_CONFIG 格式

    更新于 2026年9月18日
  • #3697

    mlx-lm/mlx-vlm 是否可以保持最新?

    更新于 2026年9月18日
  • #3725

    下载器页面显示的模型文件大小不正确

    更新于 2026年9月18日
  • #3704

    损坏缓存管理

    更新于 2026年9月18日
  • #3723

    在 qwen4_exp (M3 Ultra) 上,服务器正常运行时间使解码吞吐量下降了约 3.2 倍:在运行约 10 小时后为 20.5 tok/s,而新进程为 66.5 tok/s

    更新于 2026年9月18日
  • #1970

    当内存只适合处理一个模型时,并发跨模型请求处理会中断

    更新于 2026年9月17日
  • #3716

    为每个 2 位检查点安装了 Bonsai/t5 加载补丁,且没有测试覆盖该路径

    更新于 2026年9月17日
  • #1835

    macOS 27: 长上下文推理比 macOS 26.6 慢 10 倍(即使在修复 HOST_VM_INFO64 后也是如此)

    更新于 2026年9月17日
  • #3706

    macOS 27: 定期清除 Metal 缓存时会触发 kIOGPUCommandBufferCallbackErrorTimeout,然后引擎无法自行恢复 (0.5.7, M3 Ultra)

    更新于 2026年9月17日
  • #3709

    PDF 处理引擎无法运行

    更新于 2026年9月17日
  • #3699

    SSD 前缀缓存在 qwen4_exp 混合模式下永远不存储: 当边界快照启用时, available_boundaries=0

    更新于 2026年9月17日
  • #3690

    TurboQuant KV 缓存 (4 位) 会在命中前缀缓存的请求中默默地损坏详细信息的检索

    更新于 2026年9月17日
  • #3707

    [功能请求] 适用于推理工作负载的原生 macOS 菜单栏可观察性

    更新于 2026年9月16日
  • #2029

    服务器死机,显示"[METAL] 命令缓冲区执行失败: 导致 GPU 超时错误"

    更新于 2026年9月16日