[错误] shapeCache LRU 回收已使用的 ShapeTuples → "对象已被回收" → GPU 设备卡死 (0.2.83 中引入的回退)
□ 躯体
减记 □ 总结
从0.2.83开始,在低端集成GPU上生成可靠故障 `错误:物体已被处理',然后将整页取下' WebGPU设备("DXGI ERROR DEVICE HUNG"). 重新装入页面不足以恢复—— 浏览器必须完全重新启动 。
**0.2.82不受影响。 ** 相同的机器,相同的模型,相同的重量,相同的快取.
触发器与即时长度相关:短促工作,过去大致 120个信使每次都失败
我相信原因就是 0.2.83中加上的"变相卡切" 其LRU驱逐回调 在被缓存的“ShapeTuple”物体上拨打“处理”电话,而呼叫者可能仍然持有这些物体。
□ 环境
{\fn黑体\fs22\bord1\shad0\3aHBE\4aH00\fscx67\fscy66\2cHFFFFFF\3cH808080}你觉得呢? |-|-|-.
- */
- AMD Radeon(TM)图形(集成),`VENDOR=0x1002 DEVICE=0x15e7'
- 司机 `31.0.12042.2002 ' XWebGPU:硬件加速) QQ OS/浏览器 QQ Windows 11, Chrome ("chrome://gpu" reports WebGPU:硬件加速".
- 型号 * =wen3-1.7B-q4f16 1-MLC ' 、=wen3-0.6B-q4f16 1-MLC ' 、*=wen3.5-2B-q4f16 1-MLC`
WebWorkerMLCENGine'发动机(还复制了ServiceWorkerMLCENGine')。
□再现.
{\fn黑体\fs22\bord1\shad0\3aHBE\4aH00\fscx67\fscy66\2cHFFFFFF\3cH808080}你来干什么?
- 从“@mlc-ai/web-LLM”导入为网络;
Const 引擎 = 新网络. WebWorkerMLCENGINGine (英语: 新 Worker(新 URL (.)/ worker.js),导入.meta.url,{类型:"模块"}),, (三) 等待 engine.reload ("Quen3-1.7B-q4f16 1-MLC",{上下文 窗口 大小:4096});
// 作品: 提示最多为~100个字符(~90个令牌) // 失败:~130个字符(~120个符)及以上——每次 等待引擎. chat. completes.create({) 消息:[{角色:"用户",内容:LONG PROMPT}],, 流: 真实,
- ;
结果是0.2.84,在** single**发动机和** single**内拉出快长
`重载()'(即时长度是唯一变量):
20个字符 14.4 个字符 11.4 60个字符 5.6个字符 80克 2.7克 100克 4.4克 130克 已处理
在0.2.82上完全一样的斜坡, 相同的机器,相同的型号:
100 5.8s 130 5.9s 160 6.2s 200 6.7s 240 7.0s 280 9.7s 327 10.8s 10.9s 800 10.0s
有两点值得注意 有关失败的案例:
* 耐用度不会随时间推移而增长** (20Char案是 " 最慢 " 的案件)
(第14.4节)。 解码很快乐地发出上百个令牌. 只有预补休息。
* 与`系统 ' 作用无关:`系统 ' +16个字符成功,而
327个字符塞入一个“用户”信息失败。
一旦失败, GPU 设备就不再用于该页面 :
ID3D12 Device: Get Device Removed Reason 与 DXGI ERROR DEVICE HUNG (0x887A0006) 失败 在“ GPUAdapter” 上执行“ requestDevice” 失败: D3D12 创建命令队列失败 与 DXGI ERROR DEVICE REMOVED (0x887A0005) 连接
□双虫
我从unpkg的版本中传播了已建成的“lib/index.js”:
QQ版本 出自“ 形状卡切” 的出处 发布 QQ 结果 QQ
|.
0 2025-11-24 作品 |.
0 2026-02-17 作品 出炉 2026-02-17
|0.2.82 | 0 |
. . . . . . .内容来源: mlc-ai/web-llm