智谱发布GLM-5.3-Flash:320B参数多模态模型开源,定价降至Opus 4.8的1/40
智谱上线并开源GLM-5.3-Flash(320B-A18B),为GLM-5系列首个原生多模态模型,AA综合智能指数达57分,与Claude Opus 4.8持平。定价仅为GLM-5.3的1/10(限时1/20),为Opus 4.8的1/40,并首次在大规模流量中采用国产芯片集群提供算力支持。
智谱今日宣布正式上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列中首个原生多模态模型。该模型在AA综合智能指数测试中取得57分,与Anthropic的Claude Opus 4.8分数持平,标志着国产模型在通用智能水平上已与国际顶尖产品对齐。
定价策略是本次发布的核心亮点。GLM-5.3-Flash的API调用价格仅为GLM-5.3标准版的十分之一,限时优惠期间进一步降至二十分之一,同时仅为Claude Opus 4.8定价的四十分之一。这一价格定位使得高端多模态模型的调用门槛大幅降低,为中小型开发者和企业提供了更经济的选项。
在算力基础设施方面,GLM-5.3-Flash首次在大规模生产流量中采用国产芯片集群提供支持。这一举措不仅降低了对海外算力供应链的依赖,也验证了国产芯片在高负载场景下的实际可用性,对国内AI生态的自主可控具有积极意义。
目前,该模型已接入智谱自家的ZCode平台,并同步开放API接口供开发者调用。开源策略与低价API的组合,预计将吸引大量开发者基于GLM-5.3-Flash进行应用开发,尤其在多模态理解、智能体交互等场景中可能产生新的用例。
此次发布延续了智谱在开源与商业化并行的路线,但将价格下探至行业低点,可能引发同类模型定价的连锁反应。对于行业而言,这既是技术普惠的体现,也预示着多模态模型竞争将从参数规模转向效率与成本控制的新阶段。