我国大模型日均词元调用量破500万亿,推理算力需求激增
摘要
截至2026年6月,我国大模型日均词元调用量突破500万亿,稳居全球第一梯队。旗舰模型更新周期缩短至月级,竞争重心转向智能体落地与生态构建。腾讯混元3上线首周Token调用量较上代激增68倍,推理算力需求随之爆发。
截至2026年6月,我国大模型日均词元调用量已跨越500万亿大关,这一数字标志着中国在人工智能领域的规模化应用已进入新阶段。来自行业的最新统计显示,国内主流大模型在全球竞争格局中稳居第一梯队,其技术迭代速度与应用广度均处于国际领先水平。
当前,旗舰级大模型的更新节奏已压缩至以月为单位,行业竞争的核心正从单一模型能力比拼,转向智能体落地场景的深耕与生态体系的构建。这一转变直接推动了推理侧算力需求的指数级增长,成为驱动AI基础设施扩容的关键力量。
作为这一趋势的典型样本,腾讯混元3正式版在发布后的第一周内,其Token调用量相比上一代混元2实现了68倍的跃升。这一数据不仅反映了新一代模型在性能与效率上的显著提升,也揭示了市场对高能力推理服务的迫切渴求。
业内观察人士指出,词元调用量的爆发式增长,与智能体在金融、制造、医疗等行业的渗透率快速提升密切相关。随着多模态交互与复杂任务处理能力的增强,大模型正从工具型应用向生产系统核心组件演进,对实时响应的算力保障提出了更高要求。
面对如此迅猛的算力需求,国内云服务商与芯片厂商正加速协同,通过优化推理架构与部署策略来应对挑战。可以预见,在竞争焦点转向落地与生态的背景下,谁能更高效地承接这一波算力洪峰,谁就有望在下一阶段的行业洗牌中占据有利位置。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗