传统的 AI 配音在面对影视、动画等高标准场景时,常因难以匹配复杂的情绪爆发和精准口型而遭遇瓶颈 … 针对这一痛点, ** 通义实验室 ** 正式发布并开源了首个影视级多场景配音多模态大模型 ——Fun-CineForge … Fun-CineForge 在词错率(WER/CER)、唇部同步度 (LSE-C/D) 及音色相似度上均显著优于 DeepDubber-V1 等基线模型。
暂无讨论,说说你的看法吧
传统的 AI 配音在面对影视、动画等高标准场景时,常因难以匹配复杂的情绪爆发和精准口型而遭遇瓶颈 … 针对这一痛点, ** 通义实验室 ** 正式发布并开源了首个影视级多场景配音多模态大模型 ——Fun-CineForge … Fun-CineForge 在词错率(WER/CER)、唇部同步度 (LSE-C/D) 及音色相似度上均显著优于 DeepDubber-V1 等基线模型。