Qwen4-Flash
阿里云
热门 已备案 —
输入价格
¥0.3/ 百万 token
输出价格
¥1.2/ 百万 token
上下文
1M
免费额度
100 万/日
查看官方定价文档 ↗ 价格以厂商官网为准,本站每日核对
简介
阿里云百炼平台近日完成模型服务矩阵升级,集中提供千问及第三方模型,覆盖文本、图像、音频、视频等全模态能力。平台同步推出专业ASR与端到端语音对话方案,以及图像视频生成编辑功能,面向开发者开放多版本模型广场,强化企业级AI应用构建基础。
阿里云百炼平台日前对其模型服务体系进行了系统性梳理与升级,集中展示了千问系列及第三方模型的综合服务能力。此次更新后,平台明确覆盖文本、图像、音频、视频四类模态,旨在为开发者提供更清晰、更完整的AI能力调用入口。
在视觉生成领域,百炼支持通过文本或图片直接生成图像与视频,并附带编辑、参考及高分辨率输出功能。这意味着开发者可以在同一平台内完成从概念描述到成品素材的全流程创作,减少了跨工具调用的复杂度。
语音能力方面,平台提供了两条技术路径:一是面向专业场景的ASR(自动语音识别)方案,强调识别精度;二是基于大模型的语音方案,侧重灵活性。此外,平台还推出了端到端语音对话能力,无需分别调用ASR和TTS模块,即可实现完整的语音交互闭环。
值得注意的是,百炼的多模态能力并非简单并列,而是强调融合理解与生成。平台在文本、图像、音频、视频之间建立了交叉调用的技术基础,使开发者可以构建更复杂的跨模态应用场景。
目前,用户可前往模型广场查看所有千问系列、第三方、领域专用及历史版本模型。这一集中管理入口的开放,降低了模型选型与版本对比的难度,为企业在实际业务中落地AI能力提供了更便捷的基础设施支撑。
本文由新大陆基于公开信息编辑整理
信息来源:阿里云 官方文档 ↗