时间:2026年9月1日
地点:合肥(科大讯飞总部)
人物:科大讯飞,词元星火(科大讯飞全资子公司)
事件详情:9 月 1 日,科大讯飞全资子公司词元星火正式推出并开源星火 X2.5-4B 与星火 X2.5-1.7B 两款端侧通用大模型。两款模型原生支持最长 100 万 Token 上下文窗口,是端侧模型中首个实现百万级上下文能力的开源模型,采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力进行优化。基于全国产算力平台完成全流程训练,使用约 20 万亿 Token 多样化数据进行预训练,并通过高质量监督微调与强化学习训练。
背景:随着大模型加速进入手机、PC、汽车座舱、智能家居与机器人等终端设备,端侧模型的核心期待从"断网能聊几句"升级为"能否在本地完成完整任务"。此前端侧模型处理长内容常需切段提问,存在前情遗忘、信息遗漏等问题。星火 X2.5 系列通过原生 100 万 Token 上下文,把"在本地处理百万级信息"的工程门槛降到 4B/1.7B 模型规模。9 月 7 日科大讯飞将正式发布新一代旗舰通用大模型星火 X2.5,进一步升级代码与智能体能力。
影响:星火 X2.5-4B 和 1.7B 在 Hugging Face、GitHub 等平台开放模型权重、代码仓库与部署文档,对应模型 API 也已上线讯飞星辰 MaaS 平台(限时免费)。部署层面支持英伟达、华为、海光及后摩等硬件平台,兼容 vLLM、SGLang、llama.cpp 等主流推理框架,可通过 Ollama、LM Studio 等工具快速部署,并支持使用 LLaMA-Factory 开展增量训练。多硬件、多框架适配显著降低开发者在不同环境中部署、微调与应用端侧模型的门槛。全国产算力训练为端侧智能构建了自主、可持续演进的技术底座。
总结:科大讯飞通过开源 4B/1.7B 端侧通用大模型并原生支持百万 Token 上下文,把"在本地读完整文档、做完整任务"的能力下沉到中小尺寸模型,反映国产端侧 AI 正在从"能对话"向"能干大活"演进,并有望加速手机、PC、汽车座舱、智能家居、机器人等终端的本地 AI 体验升级。
参考来源:
1. https://new.qq.com/rain/a/20260901A09WFD00
2. https://www.toutiao.com/article/7680565941717041673/
3. https://so.html5.qq.com/page/real/search_news?docid=70000021_5356a9673f711352
4. https://news.dayoo.com/finance/202609/01/171077_54998713.htm
5. https://so.html5.qq.com/page/real/search_news?docid=70000021_1886a9643e537852







