transformers.js · Issues· 257 开放
在 GitHub 打开本地同步的开放议题(评论请到 GitHub 查看)
- #1719
[问题] 4.2.0 版 (2019 年 4 月 23 日) 之后的下一版本的发布计划是什么?
question更新于 2026年9月11日 - #1767
创建引用会话( ) 提醒拒绝的会话承诺, 打破会话后每次创建
更新于 2026年9月9日 - #1749
onnx-community/OpenMed-PII-SuperClinical: q8 静默返回接近机率的 logits; fp16 和 q4f16 无法加载
更新于 2026年9月2日 - #1754
[错误] 对编码器-解码器模型,忽略 model_file_name 参数;无法覆盖硬编码的 _quantized 后缀
bug更新于 2026年8月22日 - #1750
在一个小型嵌入模型上,WASM 比 WebGPU 快了 ~9.6 倍 - 我们建立了一个开放的基准,以寻找其他哪些地方也是如此
enhancement更新于 2026年8月20日 - #1748
Chrome 153 WebNN API: deviceType: 'webnn-npu' 被拒绝,必须使用 'npu'
更新于 2026年8月19日 - #1310
对 nvidia/parakeet-tdt 的支持
new model更新于 2026年8月14日 - #1599
[performation] Quen3.5-4B (q4f16) 为~3x慢解码+~20x慢解码 TTFT对WebGPU上的Qwen3-4B (transfers.js 4.0.0-next
bug更新于 2026年8月14日 - #1741
[WebGPU] WebGPU 解码在 S=2048/4096/6144 时永久性地降低了约 3 倍
更新于 2026年8月12日 - #1739
在 WebGPU 上, Whisper ASR 流程每 30 秒段丢失约 650 MB 的 GPU 内存(两种 `return_timestamps` 模式)
更新于 2026年8月3日 - #1736
Unigram 分词器的 CharTrie 占用约 200+ MB 的 RSS (约 166 MB 的 JS 堆) 来处理 XLM-R 规模的词汇表
更新于 2026年8月2日 - #1728
[WebGPU] embedding gemma-300m-ONNX q4/q8 静默地生成了错误的嵌入(cos ~0 与 WASM 相比);fp32 正确
更新于 2026年7月22日 - #1634
@huggingface/transformers.js 4.0.1: onnxruntime-node 1.24.3 不包含 x64 darwin (MacOS) 绑定。
bug更新于 2026年7月16日 - #1724
LFM 使用 {%- generation -%},仅在较新的 jinja 中可找到,而 transformers.js 不使用此变量。
bug更新于 2026年7月16日 - #1328
由 JSON 规范指导的输出生成
enhancement更新于 2026年7月11日