Qwen3-TTS · Issues· 55 开放
在 GitHub 打开本地同步的开放议题(评论请到 GitHub 查看)
- #353
[商业用途说明] 预设语音 Sohee 的输出是否可用于付费 YouTube 视频?
inactive更新于 2026年9月16日 - #371
调整损失与生成不一致(双重移位 + 丢失子信号隐藏) — 请合并 #278
更新于 2026年9月16日 - #294
是否有计划发布 25Hz TTS 模型?
inactive更新于 2026年9月14日 - #343
微调后的 1.7B 语音: 短语/开场语不稳定(音色错误,偶尔会发生性别转换),而长语句则稳定
inactive更新于 2026年9月13日 - #369
25Hz 分词器: qkv_attention_manual 从不对填充的关键字进行掩码处理 (bool masked_fill),短注意力窗口会产生错误的输出
更新于 2026年9月13日 - #350
不支持多并发推理
inactive更新于 2026年9月7日 - #347
在 Papers with Code 上验证评估
inactive更新于 2026年9月6日 - #365
finetuning/sft_12hz.py: 检查点保存不原子化(可能会默默地保留基础权重),在主机 RAM 中的模型大小达到 2 倍时达到峰值
更新于 2026年9月4日 - #323
微调 Qwen3-TTS-12Hz-1.7B-Base 适用于孟加拉语:外国/印度语口音偏向和缺乏自然性
inactive更新于 2026年8月26日 - #340
AMD MI300X - Qwen/Qwen3-TTS-12Hz-1.7B-Base - 语音克隆段错误 (核心已转储)
inactive更新于 2026年8月22日 - #341
语音克隆 (ICL) 生成会在请求的文本之前回放参考音频的尾部
更新于 2026年8月20日 - #359
功能请求: 原生意大利语预设语音 (男性 + 女性)
更新于 2026年8月19日 - #179
通过微调基础结果,每个训练周期的语音速度都会逐渐提高
更新于 2026年8月19日 - #337
talker_hidden_states 没有正确获取
更新于 2026年8月18日 - #55
用于日语和韩语的音频不完整。
更新于 2026年8月17日