Qwen-Audio-3.1 全家桶上线:五模型覆盖音频全链路,ASR 最高降价 95%
摘要
Qwen 发布 Qwen-Audio-3.1,升级 ASR、TTS、Realtime 并新增 TTS-Next 与 ASR-Next,五个模型覆盖音频理解、生成、交互与创作。全线降价,TTS 约 70% off、Realtime 约 85% off、ASR 最高 95% off。Realtime 支持边说边听、随时打断,检测到低落情绪时会放慢语速并共情回应。
Qwen 正式推出 Qwen-Audio-3.1,对旗下音频模型矩阵进行了一次系统性扩充与升级。此次发布共涉及五个模型,覆盖音频理解、生成、交互与创作四个方向,原有的 ASR、TTS 与 Realtime 三条产品线均获得更新。
在既有能力升级之外,Qwen 新增了两款模型:面向音频创作的 TTS-Next,以及面向音频理解的 ASR-Next。两者分别补强了生成侧与理解侧的能力,使 Qwen-Audio-3.1 形成从识别到合成、从实时交互到内容创作的完整链条。
交互体验方面,Realtime 模型支持边说边听、随时打断,并在检测到用户情绪低落时放慢语速、以共情方式回应,将情绪感知融入了实时语音对话流程。
价格策略同步调整。Qwen 对全线音频模型下调定价,其中 TTS 约 70% off、Realtime 约 85% off、ASR 最高 95% off,降幅覆盖理解、生成与交互各环节。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗