Qwen3.8-Flash
阿里云
热门 已备案 —
输入价格
¥0.15/ 百万 token
输出价格
¥1.5/ 百万 token
上下文
1M
免费额度
100 万/模型(90 天)
轻量高性价比
适用场景
场景聚合 · Token 包参考
新人免费额度 ¥0
90 天有效,仅限实时推理
轻量包月包 ¥7.5
按 ≤128K 档输入价估算
节省计划包 ¥750
AI 通用型节省计划可至 8 折以下
Token 包为按刊例价的估算参考,实际支出以用量结构为准;厂商官方资源包以购买页为准。
查看官方定价文档 ↗ 价格以厂商官网为准,本站每日核对
简介
阿里云百炼平台 Qwen3.8-Flash 支持百万 token 上下文,输入 ¥0.15/百万 tokens(≤128K 档)起,128K 以上阶梯递增;新用户每模型 100 万 token 免费(90 天有效)。平台另有 Qwen3.8-Max(¥2.4/¥9.6)等全系列矩阵。
阿里云百炼平台的 Qwen3.8-Flash 官方定价显示,模型支持 1M 上下文窗口,输入价格按请求长度阶梯计费:输入 ≤128K 时 ¥0.15/百万 tokens、输出 ¥1.5/百万;128K-256K 档 ¥0.6/¥6;256K-1M 档 ¥1.2/¥12。
百炼平台收费结构清晰:新用户每模型 100 万 token 免费额度(90 天有效,仅限实时推理),平台累计可领超 7000 万 token。主力模型价格梯度完整,Qwen3.8-Max 为 ¥2.4/¥9.6,适合复杂任务。
省钱路径有三:Batch 调用统一五折(输入输出均半价)、上下文缓存对重复内容折扣计费、AI 通用型节省计划按月承诺消费最高可至 5.3 折。抵扣顺序为免费额度 → 资源包 → 节省计划 → 按量付费。
选型建议:高并发、成本敏感的在线服务首选 Qwen3.8-Flash;长文档与代码库分析场景可用 1M 上下文配合缓存;重推理任务升级 Qwen3.8-Max。阶梯计费按整请求判定,短请求维持低档单价即可。
本文由新大陆基于公开信息编辑整理
信息来源:阿里云 官方文档 ↗