百科.dev
全部条目AI 编程趋势榜开源项目技术资讯提交条目
登录
返回工具页

Qwen3-TTS · Issues· 55 开放

在 GitHub 打开

本地同步的开放议题(评论请到 GitHub 查看)

  • #353

    [商业用途说明] 预设语音 Sohee 的输出是否可用于付费 YouTube 视频?

    inactive更新于 2026年9月16日
  • #371

    调整损失与生成不一致(双重移位 + 丢失子信号隐藏) — 请合并 #278

    更新于 2026年9月16日
  • #294

    是否有计划发布 25Hz TTS 模型?

    inactive更新于 2026年9月14日
  • #343

    微调后的 1.7B 语音: 短语/开场语不稳定(音色错误,偶尔会发生性别转换),而长语句则稳定

    inactive更新于 2026年9月13日
  • #369

    25Hz 分词器: qkv_attention_manual 从不对填充的关键字进行掩码处理 (bool masked_fill),短注意力窗口会产生错误的输出

    更新于 2026年9月13日
  • #350

    不支持多并发推理

    inactive更新于 2026年9月7日
  • #347

    在 Papers with Code 上验证评估

    inactive更新于 2026年9月6日
  • #365

    finetuning/sft_12hz.py: 检查点保存不原子化(可能会默默地保留基础权重),在主机 RAM 中的模型大小达到 2 倍时达到峰值

    更新于 2026年9月4日
  • #323

    微调 Qwen3-TTS-12Hz-1.7B-Base 适用于孟加拉语:外国/印度语口音偏向和缺乏自然性

    inactive更新于 2026年8月26日
  • #340

    AMD MI300X - Qwen/Qwen3-TTS-12Hz-1.7B-Base - 语音克隆段错误 (核心已转储)

    inactive更新于 2026年8月22日
  • #341

    语音克隆 (ICL) 生成会在请求的文本之前回放参考音频的尾部

    更新于 2026年8月20日
  • #359

    功能请求: 原生意大利语预设语音 (男性 + 女性)

    更新于 2026年8月19日
  • #179

    通过微调基础结果,每个训练周期的语音速度都会逐渐提高

    更新于 2026年8月19日
  • #337

    talker_hidden_states 没有正确获取

    更新于 2026年8月18日
  • #55

    用于日语和韩语的音频不完整。

    更新于 2026年8月17日