知识卡片:讯飞开源星火X2.5端侧模型,原生支持百万Token上下文
- 英文标题:iFlytek Open Source Spark X2.5 On-Device Models, Natively Supporting 1M Token Context
- 英文关键词:Foundation Model; Agent; On-Device Model; Long Context; Open Source
一句话结论
科大讯飞子公司词元星火开源星火X2.5-4B与1.7B两款端侧模型,是端侧唯一原生支持最长100万Token上下文的模型。
事件概述
科大讯飞子公司词元星火开源星火X2.5-4B与1.7B两款端侧模型。模型采用混合注意力架构,围绕智能体、代码、数学与指令遵循进行优化,并基于全国产算力使用约20万亿Token完成预训练。权重已在Hugging Face开放。
方法/产品要点
- 开源两款端侧模型:星火X2.5-4B 与 1.7B。
- 原生支持最长100万Token上下文,为端侧模型中的唯一一个。
- 采用混合注意力架构。
- 优化方向:智能体、代码、数学、指令遵循。
- 基于全国产算力预训练,预训练数据量约20万亿Token。
- 适配英伟达、华为、海光等平台,支持vLLM、llama.cpp等推理框架。
主要结果或产业意义
- 在智能家居控制场景下,端到端正确率达到90.3%,平均响应时间为0.85秒。
- 端侧模型原生支持百万Token上下文,有助于降低长上下文场景的部署门槛。
- 全国产算力训练并开源,对国产AI软硬件生态具有推动意义。
为什么重要
此前端侧模型受限于显存和算力,通常难以支撑超长上下文。星火X2.5将100万Token上下文能力带入端侧,同时兼顾智能体相关任务表现,为端侧智能体应用提供了新的模型选项。其基于全国产算力预训练并适配多平台,也是国产算力大模型落地的一次进展。
局限与不确定性
- 材料未披露具体评测基准、测试集细节以及与其他端侧模型的对比数据,待核实。
- “端侧唯一原生支持100万Token上下文”的具体统计口径和截至时间未说明,待核实。
- 模型实际部署所需的硬件资源、推理速度与内存占用等细节未在材料中展开,待核实。
可用于图书/PPT/简报的角度
- 端侧大模型的长上下文能力突破。
- 国产算力训练大模型的开源案例。
- 智能体场景对端侧模型的新要求。
- 开源模型在Hugging Face上的可获取性。
原始材料
- 来源:腾讯研究院AI速递 20260902
- URL:https://m.sohu.com/a/1070665925_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334&digest_item=3
- Parent URL:https://m.sohu.com/a/1070665925_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334