GLM-5.3-Flash
智谱 AI
已备案 —
输入价格
¥0.8/ 百万 token
输出价格
¥2.8/ 百万 token
上下文
1M
免费额度
限时免费
旗舰多模态
适用场景
场景聚合 · Token 包参考
轻量体验包 ¥8
按输入单价 ¥0.8/百万估算
高并发包 ¥80
输入估算,输出另计 ¥2.8/百万
Token 包为按刊例价的估算参考,实际支出以用量结构为准;厂商官方资源包以购买页为准。
查看官方定价文档 ↗ 价格以厂商官网为准,本站每日核对
简介
GLM-5.3-Flash 是智谱 GLM-5.3 的原生多模态轻量同代款,支持图片、视频、文件与文本混合输入,1M 上下文。刊例价输入 ¥0.8/百万、输出 ¥2.8/百万、缓存命中 ¥0.23/百万,仅旗舰 GLM-5.3 的十分之一,适合高并发与多模态场景。
GLM-5.3-Flash 与旗舰 GLM-5.3 同代发布,定位是「原生多模态的轻量档」:支持图片、视频、文件与文本的混合输入,上下文 1M,官方在 Z.ai 定价页把它列为 Latest Models 的第二行。
定价是它最大的看点:输入 ¥0.8/百万 tokens、输出 ¥2.8/百万、缓存命中 ¥0.23/百万,只有旗舰 GLM-5.3(¥8/¥28/¥2)的十分之一。发布期官方做过两周 5 折促销,目前折扣期已结束,按刊例价执行。
与竞品的对应关系:在国产阵营里,它的直接对手是阿里 Qwen3.8-Plus(¥0.8/¥2.0)与字节豆包 2.1-turbo(¥3/¥15)。GLM-5.3-Flash 的差异点在多模态原生支持与 1M 上下文,视觉类负载比纯文本模型更省事。
选型建议:需要看图读视频又要控制成本时优先考虑这一档;纯文本高并发场景可以先拿它和 Qwen3.8-Flash 跑同一套评测再定。价格随官网活动调整,接入前以定价页实时显示为准。
本文由新大陆基于公开信息编辑整理
信息来源:智谱 AI 官方文档 ↗