阿里Qwen-Audio-3.0语音模型上线:ASR、TTS、实时交互全球评测“大满贯”

2026-08-18 10:36:32   |   微观猎人   |   5222

8月18日,据报道,阿里云宣布,自研Qwen-Audio-3.0系列语音模型已正式上线千问AI平台和阿里云百炼平台,开发者可通过API调用或订阅Token Plan使用。

该系列包含三款产品:语音识别模型Qwen-Audio-3.0-ASR、语音合成模型Qwen-Audio-3.0-TTS,以及实时语音交互对话模型Qwen-Audio-3.0-Realtime。根据全球权威AI评测平台Artificial Analysis今年7月的语音排行榜,该系列一举斩获ASR、RealTime和TTS三大赛道全球第一,实现“大满贯”。

在技术表现上:

- ASR模型在包含中文方言、多语言混合及专业领域术语的测试集上均保持高准确率

- TTS模型支持多语种、多方言,并支持控制情绪、语气与节奏

- Realtime模型支持端到端语音理解与对话,可边听边说、随时打断追问,并支持工具调用

目前,该系列模型已在千问App、千问办公、Qoder等产品中落地应用。分析人士认为,Qwen-Audio-3.0在ASR、TTS与实时交互三大赛道同时登顶,有望推动语音交互从“能听会说”向“实时深度理解”演进,进一步提升AI应用的听觉智能水平。

特别提醒:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字、图片等内容的真实性、完整性、及时性本站不作任何保证或承诺,请自行核实相关内容。本站不承担此类作品侵权行为的直接责任及连带责任。如若本网有任何内容侵犯您的权益,请及时发送相关信息至bireading@163.com,本站将会在48小时内处理完毕。

阿里Qwen-Audio-3.0语音模型上线:ASR、TTS、实时交互全球评测“大满贯”

2026-08-18 10:36:32 浏览量: 5222 作者: 微观猎人

8月18日,据报道,阿里云宣布,自研Qwen-Audio-3.0系列语音模型已正式上线千问AI平台和阿里云百炼平台,开发者可通过API调用或订阅Token Plan使用。

该系列包含三款产品:语音识别模型Qwen-Audio-3.0-ASR、语音合成模型Qwen-Audio-3.0-TTS,以及实时语音交互对话模型Qwen-Audio-3.0-Realtime。根据全球权威AI评测平台Artificial Analysis今年7月的语音排行榜,该系列一举斩获ASR、RealTime和TTS三大赛道全球第一,实现“大满贯”。

在技术表现上:

- ASR模型在包含中文方言、多语言混合及专业领域术语的测试集上均保持高准确率

- TTS模型支持多语种、多方言,并支持控制情绪、语气与节奏

- Realtime模型支持端到端语音理解与对话,可边听边说、随时打断追问,并支持工具调用

目前,该系列模型已在千问App、千问办公、Qoder等产品中落地应用。分析人士认为,Qwen-Audio-3.0在ASR、TTS与实时交互三大赛道同时登顶,有望推动语音交互从“能听会说”向“实时深度理解”演进,进一步提升AI应用的听觉智能水平。

,

Copyright ©2018 铋读网 All Rights Reserved.

京ICP备18051707号

京公网安备 11011302001633号