快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

论文 今天 · 星期一 · 08-31 14:03 约 1 分钟读完

腾讯混元开源Hy4 preview:770B总参数与1M上下文

摘要

腾讯混元发布旗舰模型Hy4 preview,总参数770B,激活参数49B,支持1M上下文,现已开源并上线腾讯云TokenHub和OpenRouter,为AI开发者提供高性能长文本处理方案。

腾讯混元今日正式发布新一代旗舰模型Hy4 preview,该模型以770B总参数、49B激活参数及1M上下文长度的配置,成为当前开源大模型领域的重要新成员。这一参数规模在保证推理效率的同时,显著提升了模型对超长文本的处理能力。

Hy4 preview采用MoE架构,通过激活少量参数实现高效计算,其1M上下文长度意味着模型能够一次性处理约数十万字的内容,适用于复杂文档分析、长对话生成等场景。该模型现已开源,开发者可通过腾讯云TokenHub和OpenRouter平台直接调用。

此次发布是腾讯混元在开源生态中的又一布局。此前,腾讯混元已推出多款不同规模的开源模型,而Hy4 preview的推出进一步丰富了其产品矩阵。从技术路径看,Hy4 preview的1M上下文能力对标了当前行业前沿水平,为长文本应用提供了新的基础设施选项。

对于AI行业从业者而言,Hy4 preview的开源意味着可以基于其强大的长文本处理能力进行定制化开发,而无需从零训练模型。同时,腾讯云TokenHub的上线也降低了部署门槛,使得企业能够快速集成该模型。不过,其实际性能表现仍需在具体任务中验证。

随着开源模型的竞争加剧,Hy4 preview的发布或将推动长文本处理技术的普及,并影响后续模型的设计方向。腾讯混元表示,将持续迭代模型能力,但未透露后续版本的具体时间表。

腾讯混元Hy4 preview开源模型大语言模型
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词