最新消息:关注人工智能 AI赋能新媒体运营

阿里Qwen-Audio-3.0语音模型上线千问平台,国际评测获"大满贯"

科技资讯 admin 浏览

阿里巴巴发布Qwen-Audio-3.0系列语音模型

阿里巴巴近日在千问AI平台正式上线Qwen-Audio-3.0系列语音模型。该系列包含三款模型:语音识别大模型Qwen-Audio-3.0-ASR、语音合成大模型Qwen-Audio-3.0-TTS,以及实时语音交互对话模型Qwen-Audio-3.0-Realtime。

据官方介绍,该系列模型在Artificial Analysis今年7月的语音排行榜中,获得语音识别(ASR)、实时交互(RealTime)和语音合成(TTS)三项全球第一。

Qwen-Audio-3.0系列模型排名

三款模型各有侧重:ASR模型支持复杂语境与专业领域识别;TTS模型支持多语种、多方言,可精准控制情绪、语气与节奏;Realtime模型实现端到端语音理解与对话,支持随时打断追问及工具调用,目前已应用于千问App、千问办公及Qoder等产品。

此外,千问AI平台近期还更新了Qwen3.8-Max、Qwen-image3.0pro及Wan3.0等主力模型,形成覆盖文本、代码、语音、图像和视频的全模态模型矩阵。平台同步推出Token Plan订阅服务限时优惠,个人版39元/月起,团队版最高可享7.6折优惠。