阶跃星辰一口气放出 StepAudio 3 系列五款模型:StepAudio 3 TTS(语音生成)、StepAudio 3 Gen(完整音频生成)、StepAudio 3 Realtime(实时语音交互)、StepAudio 3 ASR(语音识别)和 StepAudio 3 Music(音乐创作)。在 Artificial Analysis Speech Reasoning 榜单中,StepAudio 3 Realtime 以 99.7% 的语音推理准确率位列全球第一;在 Artificial Analysis 非流式语音识别准确性榜单中,StepAudio 3 ASR 的 WER(词错误率)仅 1.7%,并列全球第一。

