快讯 23:59阿里预判三年内原生全模态统一生成模型将落地23:46Agent时代,CPU的价值该重估了22:35Meta macOS AI助手Muse曝0-day漏洞:本地应用可窃取账户令牌 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期三 · 09-23 17:11 约 1 分钟读完

Qwen-Audio-3.1 全家桶上线:五模型覆盖音频全链路,ASR 最高降价 95%

摘要

Qwen 发布 Qwen-Audio-3.1,升级 ASR、TTS、Realtime 并新增 TTS-Next 与 ASR-Next,五个模型覆盖音频理解、生成、交互与创作。全线降价,TTS 约 70% off、Realtime 约 85% off、ASR 最高 95% off。Realtime 支持边说边听、随时打断,检测到低落情绪时会放慢语速并共情回应。

Qwen 正式推出 Qwen-Audio-3.1,对旗下音频模型矩阵进行了一次系统性扩充与升级。此次发布共涉及五个模型,覆盖音频理解、生成、交互与创作四个方向,原有的 ASR、TTS 与 Realtime 三条产品线均获得更新。

在既有能力升级之外,Qwen 新增了两款模型:面向音频创作的 TTS-Next,以及面向音频理解的 ASR-Next。两者分别补强了生成侧与理解侧的能力,使 Qwen-Audio-3.1 形成从识别到合成、从实时交互到内容创作的完整链条。

交互体验方面,Realtime 模型支持边说边听、随时打断,并在检测到用户情绪低落时放慢语速、以共情方式回应,将情绪感知融入了实时语音对话流程。

价格策略同步调整。Qwen 对全线音频模型下调定价,其中 TTS 约 70% off、Realtime 约 85% off、ASR 最高 95% off,降幅覆盖理解、生成与交互各环节。

QwenQwen-Audio-3.1语音模型ASR
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
50
企业落地案例
6
完整版提示词