Prime Intellect 推出推理平台 Prime Inference,GLM-5.3 端点同步上线
摘要
Prime Intellect 正式发布推理平台 Prime Inference,提供 serverless 端点与预留容量两种服务模式,跨数据中心支持前沿开源模型。该平台内部日均处理近一万亿 token,并已上线 GLM-5.3 端点。
Prime Intellect 近日推出其推理平台 Prime Inference,正式进入 AI 推理服务赛道。该平台面向前沿开源模型提供跨数据中心的推理能力,试图在开源模型部署需求持续增长的背景下占据一席之地。
从产品形态看,Prime Inference 同时提供 serverless 端点与预留容量两种模式。serverless 端点适合调用弹性要求较高的场景,预留容量则面向需要稳定算力保障的用户,二者共同构成平台的核心服务矩阵。
值得关注的是,该平台已上线 GLM-5.3 端点,用户可直接通过 Prime Inference 调用这一模型。跨数据中心的服务架构意味着推理请求可在不同数据中心间调度,以提升资源利用效率与响应能力。
据披露,Prime Intellect 内部每天通过该平台处理近一万亿 token。这一规模既体现了平台的实际承载能力,也为其对外服务提供了工程验证基础。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗