数字人侧叫”语音音色”,直播侧叫”直播音色”,两边各有各的库,都能添加声音合成或声音克隆音色,保存前直接试听。更妙的是直播换音色不用动直播服务:客户端对外只暴露一个带 Voice: 前缀的 provider 名,其余路由自己消化,以后新增音色,直播端一行代码都不用改。从 v2.0.0 的工作流引擎、20+小工具与 CLI,到 v2.2.0 的文生图生视频、v2.3.0 的接口开放、v2.4.0 的抠像与翻唱,再到这次 v2.5.0 把云端语音和音色管理收进一套体系,AIGCPanel 的路线很清晰:把模型装一次,让声音能被反复调用。

