Qwen 推出原生全模态模型 Qwen3.8-Omni-Flash,音视频智能体任务交付能力升级
摘要
Qwen 发布下一代原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频和视频输入及 1M token 上下文窗口。29 项评测平均分较 Qwen3.5-Omni-Plus 提升超 25%,音频输入每小时价格下降超 98%,音视频输入每小时价格下降超 93%。
Qwen 今日发布下一代原生全模态模型 Qwen3.8-Omni-Flash,该模型定位为面向音视频智能体任务交付的原生全模态解决方案。
从能力维度看,Qwen3.8-Omni-Flash 支持文本、图像、音频和视频四类输入,并具备 1M token 的上下文窗口,可覆盖长时序、多模态的复杂任务场景。
性能方面,在 29 项评测中,Qwen3.8-Omni-Flash 的平均分较上一代 Qwen3.5-Omni-Plus 提升超过 25%,显示出模型在多模态理解与任务执行上的整体进步。
成本层面同样出现显著变化:音频输入每小时价格下降超过 98%,音视频输入每小时价格下降超过 93%。这一价格调整有望降低音视频智能体应用的部署门槛。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗