#31627·onnxruntime

在 macOS 上运行并发多线程推理时,WebGPU EP 会崩溃

作者: altunenes创建于 2026年8月4日更新于 2026年9月17日
标签platform:webep:WebGPUep:CoreML

· 说明问题

** 说明:** 将此期作为第27592号的续作再打开,虽然是活体(而我无法点击再打开),但被被被 stale bot 自动关闭了,可再生bug. 在最新的ORT(`v1.28')中确认仍然存在,因此希望创建一个新的机构。

WebGPU执行提供者在多线程创建会话并同时运行推论时会崩溃于macOS(Apple Silicon)上. 相撞是非决定性的,在每次跑道上都显示不同的出错,表明道恩金属后端有一个赛跑条件.

被观测到的相撞( 非决定性的, 每个跑步不同) 运行 1 — 金属断言 :

**-[AGXG15G 家庭指挥员blitCommand EncoderCommon::832:**
失败的断言 ` 命令编码器已经编码到这个命令缓冲' 。

** 第2跑道——记忆腐败:** maloc: *** 对象 0x784797e90的错误:未分配释放的指针(a). `

** 第3跑道——追踪陷阱:** `[1] 56040 微量陷阱货物运行-放行-版本-RFB-640.onnx '

注释:

  • 单行会场创建和推论工作精细 - 顺序(非并行)多会场使用精细
  • CoreML EP的工作量相同

###来再生.

最小回放: https://GitHub.com/altunnes/ort-WebGPU-thread-crash 页面存档备份,存于互联网档案馆.

git Clone https://GitHub.com/altunnes/ort-WebGPU-thread-crash.git 页面存档备份,存于互联网档案馆. 货物运行-放行-版本-RFB-640.onnx (简单的面部检测模型)

重排会生成2个持续WebGPU会话,再产出5个线程,每个线程会生成一个会话并同时运行推论,而主线程也会运行对持续会话的推论.

紧急

无回复( N)

+++ 平台

麦克

操作系统版本

26.2 (中文(简体) ).

ONNX 运行时间安装

由源创建

. . . . . . .

内容来源: microsoft/onnxruntime