MNN · Issues· 35 开放
在 GitHub 打开本地同步的开放议题(评论请到 GitHub 查看)
- #4890
[错误] Omni 在连续的文本请求中重复使用过时的 PLE 输入
更新于 2026年9月18日 - #4887
[Feature/optimization] OvisOCR2 (finneted Quen3.5-0.8B) 视觉编码器推想纬度在MNN上显著高
更新于 2026年9月18日 - #4886
[错误] Omni 继承了嵌入注意力掩码,导致 Gemma 4 混合注意力生成出现问题
更新于 2026年9月18日 - #4883
qwen3.5 的 MNN 模型如何进行 GPU 推理
更新于 2026年9月17日 - #4811
Android API 推理崩溃: MNN::DeferBufferAllocator::apply() / MNN::Session::resize() 中发生 SIGABRT
type:bugplatform:androidmodule:llm更新于 2026年9月17日 - #4849
MNN 模型使用 getSessionInfo 获取的内存数据与实测的 dumpsys meminfo 存在较大差异
type:questionplatform:android更新于 2026年9月17日 - #4802
Qwen2.5-Omni-3B/7B 在最新代码上使用 opencl 进行推理时发生崩溃
type:bugbackend:openclmodule:llm更新于 2026年9月15日 - #4859
[功能请求][Android] MNN Android 应用程序已更新并集成 Hexagon NPU
更新于 2026年9月11日 - #4815
Android 内存泄露
type:questionplatform:android更新于 2026年9月11日 - #4779
[模型请求] Ling 3.0 Tiny
module:llmtype:model-request更新于 2026年9月11日 - #4833
[Android] SanaSession.initNative 发生致命崩溃 - MNN Chat 0.8.3 (P0)
type:bugplatform:androidapp:transformer更新于 2026年9月11日 - #4778
[功能请求]: Gemma 4 12B
module:llmtype:model-request更新于 2026年9月11日 - #4624
[错误] OpenCL 后端在我的手机上运行时,AI 大模型会出现溢出和参数不匹配
type:bugplatform:androidbackend:openclmodule:llmapp:transformer更新于 2026年9月11日 - #4792
已获得支持 mtk npu 的最新仓库 mnn3.6.0,使用 neuropilot-sdk-basic-7.0.8-build20240807 进行天玑 9300/8300 的 llmexport.py 导出后,使用 neruonsdk 对第一层 prompt 编译时报错
type:bugplatform:androidmodule:llm更新于 2026年9月11日 - #4716
[QNN] 使用 QNN 后端转换 Qwen3-VL-2B 时,`compilefornpu` 发生段错误。
type:bugplatform:androidmodule:llmbackend:qnn更新于 2026年9月11日