阿里云Qwen
发布时间:2026-08-17来源:互联网编辑
阿里云近日正式推出Qwen-Audio-3.0系列语音模型,现已全面上线千问AI平台与阿里云百炼平台。开发者可通过API接口调用模型功能,或选择订阅Token计划获取服务,为语音技术应用提供多样化接入方式。
该系列包含三款自主研发的语音模型:语音识别大模型Qwen-Audio-3.0-ASR、语音合成大模型Qwen-Audio-3.0-TTS,以及实时语音交互对话模型Qwen-Audio-3.0-Realtime。在国际权威AI评测平台Artificial Analysis今年7月发布的语音领域榜单中,这三款模型分别在语音识别、实时交互和语音合成三个赛道斩获全球第一,技术实力获得国际认可。
Qwen-Audio-3.0-ASR模型具备复杂语境下的精准识别能力,可处理专业领域术语及多场景语音输入;Qwen-Audio-3.0-TTS模型支持多语种与方言合成,并能通过参数调节实现情绪、语气和节奏的灵活控制;Qwen-Audio-3.0-Realtime模型则突破传统交互模式,支持端到端语音理解与对话,实现边听边说、随时打断追问的流畅交互体验。
目前,该系列模型已在千问App、千问办公、Qoder等多款产品中落地应用,覆盖智能客服、内容创作、办公协作等多个场景。此次技术升级标志着阿里云在语音交互领域的技术积累进入新阶段,为行业开发者提供更高效的语音处理解决方案。
转载说明:本文系转载内容,版权归原作者及原出处所有。转载目的在于传递更多行业信息,文章观点仅代表原作者本人,与本平台立场无关。若涉及作品版权问题,请原作者或相关权利人及时与本平台联系,我们将在第一时间核实后移除相关内容。
