科大讯飞开源星火 X2.5 端侧模型:支持百万 Token 超长上下文
科大讯飞开源星火 X2.5-4B 与 1.7B 端侧模型,原生支持 100 万 Token 上下文窗口,全流程基于国产算力训练。
AI 深度解读
2026 年 9 月 1 日,科大讯飞旗下词元星火宣布开源 Spark X2.5-4B 与 Spark X2.5-1.7B 两款端侧通用模型,其关注价值在于将原生 100 万 Token 的超长上下文处理能力拓展至轻量化端侧设备。
- 架构与训练基础:两款模型采用混合注意力架构,基于全国产算力平台与约 20 万亿 Token 数据完成预训练,重点优化智能体、代码、数学及指令遵循等核心能力。
- 场景实测表现:在售后复杂手册跨章节检索与办公双语报告生成等场景提供长文本处理支持;在 Domux 智能家居基准测试中,1.7B 模型的控制指令端到端执行正确率为 90.3%,平均响应时间为 0.85 秒。
- 部署与生态适配:模型支持英伟达、华为、海光及后摩等硬件芯片,兼容 vLLM、SGLang、llama.cpp 等主流推理框架,并已在 GitHub 和 Hugging Face 开放权重下载。
- 影响/看点:端侧模型支持百万 Token 窗口可能拓展边缘设备本地处理长文档和多轮智能体交互的适用场景,但其实际运行效率与可用性仍取决于端侧设备的显存带宽以及量化后的长文本检索精度。
- 资料依据:
- IT之家(2026-09-01):https://www.ithome.com/0/996/855.htm
- GitHub(2026-09-01):https://github.com/XHToken/Spark-X2.5
- Hugging Face(2026-09-01):https://huggingface.co/collections/XHToken/spark-x25
本内容由 AI 生成,仅供参考,请注意甄别