快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

论文 今天 · 星期二 · 09-01 11:20 约 2 分钟读完

科大讯飞开源端侧百万Token上下文模型,星火X2.5系列正式发布

摘要

科大讯飞旗下词元星火发布并开源星火X2.5-4B和1.7B端侧模型,原生支持100万Token上下文,为端侧首创。模型采用混合注意力架构,基于国产算力训练,聚焦智能体、代码等场景,已在多平台开放权重。

科大讯飞旗下词元星火今日宣布,正式推出并开源星火X2.5-4B与星火X2.5-1.7B两款端侧通用大模型。这两款模型原生支持最长100万Token的上下文窗口,据官方介绍,这是目前端侧模型中唯一达到该量级上下文支持的产品。

两款模型均采用混合注意力架构,并针对智能体、代码、数学及指令遵循等核心能力进行了专项优化。模型基于全国产算力平台完成全流程训练,预训练数据规模约20万亿Token,覆盖多样化语料。

在实际应用层面,星火X2.5系列展示了端侧大模型的落地潜力。以产品售后场景为例,用户可将完整售后手册导入模型,针对“购买10天后设备故障且使用过第三方耗材”等复杂问题,模型能够关联跨章节规定给出综合判断,并在新增条件下保持前文情境持续提供建议。在个人办公场景中,星火X2.5-4B可完成从原始数据分析到双语报告交付的全流程。

在智能家居领域,星火X2.5-1.7B在Domux智能家居测试集上,控制指令端到端执行正确率达90.3%,平均响应时间仅为0.85秒。此外,模型还适用于机器人操作控制、目标追踪、导航决策等场景,可灵活部署于机器人本体或边缘设备。

硬件兼容性方面,星火X2.5-4B和1.7B支持英伟达、华为、海光及后摩等平台,并兼容vLLM、SGLang、llama.cpp等主流推理框架,用户可通过Ollama、LM Studio等工具快速部署。即日起,模型权重已在Hugging Face、GitHub等平台开放,对应API也已上线讯飞开放平台。

科大讯飞端侧模型开源100万Token
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词