Lip-syc 的支持
Author: xushijieCreated Aug 4, 2026Updated Aug 4, 2026
相关链接: https://github.com/ATH-MaaS/Pixelle-Video/issues/104#issuecomment-5168127441 digit 数字人是基于 infinitetalk 实现lip-sync. 另外一个workflow i2v_ltx2.json (2011258580393009153) 是直接在prompt 嵌入对话,通过模型在 video_audio的latent空间内生成的。
然而,我看到还有一些workflow, 如vido_qwen_wan2.2.json(1993608528969531394), video_wan2.2.json(1991693844100100097) video_wan2.1_fusion.json(1985909483975188481) 都只是生成没有audio的视频,那这些视频后续的lip-sycn是如何实现的呢?
Source: ATH-MaaS/Pixelle-Video