核心变化

官方宣布:9月1日,科大讯飞全资子公司词元星火正式开源星火X2.5-4B与星火X2.5-1.7B两款端侧通用大模型。据AIbase等专业媒体同日报道,这是端侧首个原生支持100万Token上下文的开源方案,全程在国产算力平台训练,权重、代码仓库与部署文档已同步开放,可立即下载体验。独立验证:Hugging Face XHToken组织的Spark-X2.5-4B与1.7B仓库已公开模型卡,确认混合注意力架构、1M上下文及多硬件多框架兼容等关键信息。

关键能力与开放内容

两款模型采用混合注意力设计(1层全注意力配合3层滑动窗口),在保持性能的同时显著降低长上下文的计算与KV缓存开销,原生支持1,048,576上下文长度。预训练约20万亿token,覆盖网页、书籍、学术、代码等多源数据,并通过专用长上下文阶段与监督微调、大规模强化学习(MOPD)提升推理、代码与智能体能力,支持200种以上语言。

  • 已开放:Hugging Face XHToken/Spark-X2.5-4B 与 Spark-X2.5-1.7B 权重与配置;支持硬件包括英伟达、华为、寒武纪、海光等;兼容 vLLM、SGLang、llama.cpp、MLX 等推理框架,可通过 Ollama、LM Studio 一键部署,并支持 LLaMA-Factory 增量训练;星火MaaS平台已上线对应API并限时免费。

影响与适用范围

该发布将百万级上下文首次下放到端侧,适合需一次性读入完整售后手册、技术文档或长代码库的个人办公、代码开发与智能硬件场景。官方示例显示,模型可先梳理跨章节规则再结合新增条件给出综合判断,并在智能家居指令执行与机器人本体的操作控制、目标跟踪与导航决策中实现离线运行,降低对云端与固定预设程序的依赖。

限制与下一步

编辑提示:长上下文与智能体榜单成绩为官方及模型卡自测结果,实际效果受部署硬件、推理框架版本与提示写法影响,建议在目标设备与业务数据上验证。公开权重与文档已可获取,生产环境需按Apache 2.0许可与模型使用说明评估合规与安全。词元星火预告将于9月7日发布下一代旗舰通用大模型星火X2.5,届时将进一步升级代码与智能体能力,相关计划仍待官方后续发布。