多款模型在权威第三方 AI 模型评测机构 Artificial Analysis 榜单中位列全球第一。相比过去主要围绕语音识别或语音生成等单项能力展开竞争,StepAudio 3 将能力进一步延伸至语音理解与生成、实时推理、任务执行和音频创作的全栈能力,让 AI 不仅能够”听”和”说”,也能够理解声音背后的语义与情绪,并参与更完整的交互和内容生产过程。在 Artificial Analysis 非流式语音识别准确性榜单中,StepAudio 3 ASR 的 WER(词错误率)为 1.7%,并列全球第一。

