Qwen-Audio-3.0系列语音模型正式上线千问AI平台

刚刚,Qwen-Audio-3.0系列语音模型正式上线千问AI平台。开发者可以通过API服务调用模型能力,也可以订阅Token Plan使用。

图片

Qwen-Audio-3.0系列模型是阿里巴巴推出的自研语音模型,包括语音识别大模型Qwen-Audio-3.0-ASR、语音合成大模型Qwen-Audio-3.0-TTS、实时语音交互对话模型Qwen-Audio-3.0-Realtime。

在全球权威AI评测平台Artificial Analysis今年7月的语音排行榜上,该模型斩获语音识别(ASR)、实时交互(RealTime)和语音合成(TTS)三个赛道的全球第一,拿下“大满贯”。

其中,Qwen-Audio-3.0-ASR将语音转为文字,支持复杂语境和专业领域识别;Qwen-Audio-3.0-TTS将文字转为语音,支持多语种、多方言,可控制情绪、语气与节奏;Qwen-Audio-3.0-Realtime支持端到端语音理解与对话,可边听边说、随时打断追问,并支持工具调用。目前该系列模型已在千问App、千问办公、Qoder等产品中应用。

千问AI平台近期密集上线了多款主力模型,包括阿里巴巴新一代基座大模型Qwen3.8-Max、图像生成模型Qwen-image 3.0 pro、全新一代视频生成模型Wan3.0,以及Kimi K3等模型,从文本、代码到语音、图像和视频,开发者可以在一个平台调用不同模态的模型能力。

Token Plan订阅服务限时优惠:

个人版:

Lite 39元/月(每7天2500Credits),Standard 139元/月(4倍Lite用量),Pro 499元/月(16倍Lite用量)

团队版:

标准席位50元/席位/月(降至7.6折),高级席位550元/席位/月(降至7.9折),尊享席位1398元/席位/月

本文作者@千问AI平台。原文链接:https://mp.weixin.qq.com/s/yb4-PDno5NaacES9RfxIEA

AI情报

快手创始人宿华押注的 Voice Cursor,语音输入又卷起来了

2026-8-17 13:01:29

AI情报

元宝拍照大升级,实测有点好用

2026-8-17 18:55:12

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧