快讯 23:36AMD未发布锐龙9 5900X3D工程样品曝光:12核配32MB+96MB L3缓存16:00Ai2开源8B科学报告生成模型AstaBrief,已上线Asta平台08:00Epoch AI 测算:2025至2027年HBM产能可承载千万级并发前沿智能体 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期六 · 10-03 04:37 约 1 分钟读完

Prime Intellect 推出推理平台 Prime Inference,GLM-5.3 端点同步上线

摘要

Prime Intellect 正式发布推理平台 Prime Inference,提供 serverless 端点与预留容量两种服务模式,跨数据中心支持前沿开源模型。该平台内部日均处理近一万亿 token,并已上线 GLM-5.3 端点。

Prime Intellect 近日推出其推理平台 Prime Inference,正式进入 AI 推理服务赛道。该平台面向前沿开源模型提供跨数据中心的推理能力,试图在开源模型部署需求持续增长的背景下占据一席之地。

从产品形态看,Prime Inference 同时提供 serverless 端点与预留容量两种模式。serverless 端点适合调用弹性要求较高的场景,预留容量则面向需要稳定算力保障的用户,二者共同构成平台的核心服务矩阵。

值得关注的是,该平台已上线 GLM-5.3 端点,用户可直接通过 Prime Inference 调用这一模型。跨数据中心的服务架构意味着推理请求可在不同数据中心间调度,以提升资源利用效率与响应能力。

据披露,Prime Intellect 内部每天通过该平台处理近一万亿 token。这一规模既体现了平台的实际承载能力,也为其对外服务提供了工程验证基础。

Prime IntellectPrime InferenceGLM-5.3推理平台
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
57
企业落地案例
9
完整版提示词