AI消息速览

讯飞开源星火X2.5端侧模型,原生支持百万Token上下文

事件日期 2026-09-02 · 产业观察 · 已接受

事件日期2026-09-02
信息日期2026-09-02
入库日期2026-09-02
通道产业观察
状态已接受
来源腾讯研究院(搜狐同步)

知识卡片:讯飞开源星火X2.5端侧模型,原生支持百万Token上下文

  • 英文标题:iFlytek Open Source Spark X2.5 On-Device Models, Natively Supporting 1M Token Context
  • 英文关键词:Foundation Model; Agent; On-Device Model; Long Context; Open Source

一句话结论

科大讯飞子公司词元星火开源星火X2.5-4B与1.7B两款端侧模型,是端侧唯一原生支持最长100万Token上下文的模型。

事件概述

科大讯飞子公司词元星火开源星火X2.5-4B与1.7B两款端侧模型。模型采用混合注意力架构,围绕智能体、代码、数学与指令遵循进行优化,并基于全国产算力使用约20万亿Token完成预训练。权重已在Hugging Face开放。

方法/产品要点

  • 开源两款端侧模型:星火X2.5-4B 与 1.7B。
  • 原生支持最长100万Token上下文,为端侧模型中的唯一一个。
  • 采用混合注意力架构。
  • 优化方向:智能体、代码、数学、指令遵循。
  • 基于全国产算力预训练,预训练数据量约20万亿Token。
  • 适配英伟达、华为、海光等平台,支持vLLM、llama.cpp等推理框架。

主要结果或产业意义

  • 在智能家居控制场景下,端到端正确率达到90.3%,平均响应时间为0.85秒。
  • 端侧模型原生支持百万Token上下文,有助于降低长上下文场景的部署门槛。
  • 全国产算力训练并开源,对国产AI软硬件生态具有推动意义。

为什么重要

此前端侧模型受限于显存和算力,通常难以支撑超长上下文。星火X2.5将100万Token上下文能力带入端侧,同时兼顾智能体相关任务表现,为端侧智能体应用提供了新的模型选项。其基于全国产算力预训练并适配多平台,也是国产算力大模型落地的一次进展。

局限与不确定性

  • 材料未披露具体评测基准、测试集细节以及与其他端侧模型的对比数据,待核实。
  • “端侧唯一原生支持100万Token上下文”的具体统计口径和截至时间未说明,待核实。
  • 模型实际部署所需的硬件资源、推理速度与内存占用等细节未在材料中展开,待核实。

可用于图书/PPT/简报的角度

  • 端侧大模型的长上下文能力突破。
  • 国产算力训练大模型的开源案例。
  • 智能体场景对端侧模型的新要求。
  • 开源模型在Hugging Face上的可获取性。

原始材料

  • 来源:腾讯研究院AI速递 20260902
  • URL:https://m.sohu.com/a/1070665925_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334&digest_item=3
  • Parent URL:https://m.sohu.com/a/1070665925_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334