快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

Qwen-Flash

阿里云 · API 定价、上下文与选型参考 · 数据每日核对

Qwen-Flash
阿里云
热门 已备案
输入价格
¥0.15/ 百万 token
输出价格
¥1.5/ 百万 token
上下文
1M
免费额度
100 万/模型(90 天)
轻量高性价比
适用场景
高并发在线服务智能客服内容摘要多模态应用
场景聚合 · Token 包参考
新人免费额度 ¥0
100 万/模型 · 评测与原型验证
90 天有效,仅限实时推理
轻量包月包 ¥7.5
5000 万 · 初创业务起步
按 ≤128K 档输入价估算
节省计划包 ¥750
10 亿 · 月消费 1000+ 元团队
AI 通用型节省计划可至 8 折以下
Token 包为按刊例价的估算参考,实际支出以用量结构为准;厂商官方资源包以购买页为准。
查看官方定价文档 ↗ 价格以厂商官网为准,本站每日核对
简介

阿里云百炼平台 Qwen-Flash 支持百万 token 上下文,输入 ¥0.15/百万 tokens(≤128K 档)起,128K 以上阶梯递增;新用户每模型 100 万 token 免费(90 天有效)。平台另有 Qwen-Max(¥2.4/¥9.6)等全系列矩阵。

阿里云百炼平台的 Qwen-Flash 官方定价显示,模型支持 1M 上下文窗口,输入价格按请求长度阶梯计费:输入 ≤128K 时 ¥0.15/百万 tokens、输出 ¥1.5/百万;128K-256K 档 ¥0.6/¥6;256K-1M 档 ¥1.2/¥12。

百炼平台收费结构清晰:新用户每模型 100 万 token 免费额度(90 天有效,仅限实时推理),平台累计可领超 7000 万 token。主力模型价格梯度完整,Qwen-Max 为 ¥2.4/¥9.6,适合复杂任务。

省钱路径有三:Batch 调用统一五折(输入输出均半价)、上下文缓存对重复内容折扣计费、AI 通用型节省计划按月承诺消费最高可至 5.3 折。抵扣顺序为免费额度 → 资源包 → 节省计划 → 按量付费。

选型建议:高并发、成本敏感的在线服务首选 Qwen-Flash;长文档与代码库分析场景可用 1M 上下文配合缓存;重推理任务升级 Qwen-Max。阶梯计费按整请求判定,短请求维持低档单价即可。

阿里云百炼Qwen-Flash阶梯计费
本文由新大陆基于公开信息编辑整理
其他模型
DeepSeek-V4-Flash
深度求索 · 输入 ¥1.5 / 输出 ¥4.5
GLM-5.3
智谱 AI · 输入 ¥0.8 / 输出 ¥2.8
豆包 doubao-seed-2.1-pro
字节跳动 · 输入 ¥6.0 / 输出 ¥30.0
小米 MiMo-V2.5-Pro
小米 · 输入 ¥3.0 / 输出 ¥6.0
美团 LongCat-2.0
美团 · 输入 ¥2.0 / 输出 ¥8.0
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词