阶跃发布 StepAudio3 系列模型:五款模型同步上线开放平台

该系列覆盖真人级语音生成、完整音频生成、实时语音交互、复杂语音理解及音乐创作等场景。StepAudio3Realtime 支持原生全双工实时对话,可同时理解语义、语气、情绪、副语言及环境声音,并支持推理与语音生成并行、Tool Call 及长任务异步执行。整体来看,StepAudio3 正将语音模型能力从单一识别或生成拓展至完整音频内容生产与实时智能交互。

原文连接