快讯 23:38Dwarkesh Patel 对话 OpenAI 研究员 Noam Brown:聚焦多智能体系统与递归自我改进14:16海盗船推出 RS II 风扇、NAUTILUS II 处理器液冷14:12美ITC对苹果三星谷歌启动337调查,音频专利纠纷或波及AirPods 5在美销售 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

论文 今天 · 星期五 · 09-18 12:45

智谱 GLM-5.3-FlashX 模型上线,更快、更流畅

摘要

IT之家 9 月 18 日消息,智谱今日宣布推出 GLM-5.3-FlashX(最高 200 tokens/s),为企业与开发者带来更快、更流畅的模型体验。智谱官方表示,GLM-5.3-Flash 此前以“Ox Alpha”之名与全球开发者见面,获得海内外开发者的广泛认可,调用量持续攀升。面对快速增长的需求,智谱在 10 万张国产芯片提供的推理算力基础上,进一步加大对 Infra 侧的投入与推理优化。GLM-5.3-Flash 长期保持同尺寸最强智能水平,本次提速进一步形成智能、价格、速度的全面竞争力。GLM-5.3-FlashX API 现已上线,Model Key:GLM-5.3-FlashX。价格方面,GLM-5.3-FlashX 相比 GLM-5.3-Flash 更贵一些:模型名称上下文输入单价(元 / 百万 Tokens)输出单价(元 / 百万 Tokens)缓存存储(元 / 百万 Tokens / 小时)缓存命中(元 / 百万 Tokens)输入模态GLM-5.31M828限时免费2文本GLM-5.3-Flash1M0.82.8限时免费0.23图片、视频、文件、文本GLM-5.3-FlashX1M27限时免费0.57图片、视频、文件、文本IT之家附 API 调用方法:https://docs.bigmodel.cn/api-reference/模型-api/对话补全

正文整理中

本条快讯正在等待内容整理,稍后将在此展示完整报道。
你可以先查看下方原文出处获取信息,或浏览其他已完成的快讯。

213
收录 AI 工具
23
模型产品档案
41
企业落地案例
5
完整版提示词