快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

论文 今天 · 星期一 · 08-31 17:05 约 1 分钟读完

我国大模型日均词元调用量破500万亿,推理算力需求激增

摘要

截至2026年6月,我国大模型日均词元调用量突破500万亿,稳居全球第一梯队。旗舰模型更新周期缩短至月级,竞争重心转向智能体落地与生态构建。腾讯混元3上线首周Token调用量较上代激增68倍,推理算力需求随之爆发。

截至2026年6月,我国大模型日均词元调用量已跨越500万亿大关,这一数字标志着中国在人工智能领域的规模化应用已进入新阶段。来自行业的最新统计显示,国内主流大模型在全球竞争格局中稳居第一梯队,其技术迭代速度与应用广度均处于国际领先水平。

当前,旗舰级大模型的更新节奏已压缩至以月为单位,行业竞争的核心正从单一模型能力比拼,转向智能体落地场景的深耕与生态体系的构建。这一转变直接推动了推理侧算力需求的指数级增长,成为驱动AI基础设施扩容的关键力量。

作为这一趋势的典型样本,腾讯混元3正式版在发布后的第一周内,其Token调用量相比上一代混元2实现了68倍的跃升。这一数据不仅反映了新一代模型在性能与效率上的显著提升,也揭示了市场对高能力推理服务的迫切渴求。

业内观察人士指出,词元调用量的爆发式增长,与智能体在金融、制造、医疗等行业的渗透率快速提升密切相关。随着多模态交互与复杂任务处理能力的增强,大模型正从工具型应用向生产系统核心组件演进,对实时响应的算力保障提出了更高要求。

面对如此迅猛的算力需求,国内云服务商与芯片厂商正加速协同,通过优化推理架构与部署策略来应对挑战。可以预见,在竞争焦点转向落地与生态的背景下,谁能更高效地承接这一波算力洪峰,谁就有望在下一阶段的行业洗牌中占据有利位置。

大模型词元调用量推理算力腾讯混元3
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词