该系列包含三款自研语音模型:语音识别大模型Qwen-Audio-3.0-ASR、语音合成大模型Qwen-Audio-3.0-TTS,以及实时语音交互对话模型Qwen-Audio-3.0-Realtime。
在最新的行业词汇内部评测中,新模型对各行业专业词的“听中率”都有明显提升,其中医疗场景更是突破了 95.36%。
阿里千问发布语音合成大模型Qwen-Audio-3.0-TTS,登顶Artificial Analysis榜首
字节跳动发布Seed Audio 1.0音频创作模型,多数场景音频可用率达90%以上
阿里云发布Qwen-Audio-3.0-Realtime:毫秒响应不掉智,自主调用工具更智能
千问Qwen-Audio-3.0-Realtime正式发布
阿里发布实时语音交互对话模型Qwen-Audio-3.0-Realtime,号称懂倾听、更聪明
Stability AI推出音频模型Stability Audio 3.0,可创作6分钟歌曲
趋势科普:2026年,为什么越来越多人提LE Audio 和 Auracast?
通义端到端语音交互模型Fun-Audio-Chat发布
06/25 00:14
06/25 00:13
06/13 18:29
06/13 18:26
06/13 18:25
06/13 18:23
06/13 18:20
06/13 18:16