(来源:华为计算)
2026年9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型,作为端侧模型中唯一原生支持最长100万Token上下文的模型,把百万级信息处理能力带到本地设备。昇腾AI基础软硬件为两款模型提供了原生训练支持,并通过vLLM和SGLang两大开源推理引擎实现高效推理适配。
星火X2.5-4B和1.7B两款模型采用混合注意力架构,并围绕智能体、代码、数学和指令遵循等核心能力进行优化,在语言理解、文本创作、翻译、编程、工具调用和智能体工作流等广泛的日常任务中表现优异,支持至少200种语言,具备良好的跨语言理解、生成、翻译等基础能力,并深度适配Claude Code、Hermes、Codex、OpenClaw等开源Harness,在智能体工作流、日常代码编写、数学推理以及指令遵循等任务上综合实测能力领先业界同尺寸一流开源模型,将为车载、智能硬件、万物互联等端侧场景提供有力的模型支持。
当前,大模型正加速进入智能硬件、汽车座舱、智能家居及机器人等终端设备和场景。相比云端模型,端侧模型能够减少网络依赖和数据传输,在低延迟、离线运行和隐私保护等方面具备独特价值。但要真正帮助用户解决问题,仅仅在设备上“能对话”还不够。端侧模型还需要在有限资源下理解长文本和复杂需求,完成信息分析、任务规划与工具调用,并交付可直接使用的结果。
星火X2.5-4B和1.7B两款端侧通用大模型针对昇腾AI基础软硬件架构特性进行原生亲和设计,并基于昇腾算力完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习训练,持续提升端侧模型在推理、代码、智能体和指令遵循等任务中的表现。
在推理环节,昇腾可支持两款模型通过vLLM和SGLang两大开源推理引擎实现推理部署,推理效率达到同尺寸模型最优。在Atlas 800 A2/A3、Atlas 300系列产品上,提供了BF16/INT8精度支持;在Atlas 850E超节点上,实现了BF16/INT8/FP8精度支持。
用户及开发者可访问以下链接获取星火X2.5-4B和1.7B基于昇腾的部署指导(实际商业性能与部署方案、参数配置及软硬件环境等因素相关,并将持续优化提升):
星火X2.5-4B:
https://huggingface.co/XHToken/Spark-X2.5-4B
星火X2.5-1.7B:
https://huggingface.co/XHToken/Spark-X2.5-1.7B
自2022年以来,昇腾持续支持科大讯飞建设自主创新的万卡级AI算力平台“飞星一号、飞星二号”,双方团队通过联合攻关将大模型在昇腾AI基础软硬件上的训练效率从最初的30%-50%提升到85%-95%以上。2025年双方进一步攻克了长思维链强化学习和MoE模型全链路训练的效率难题,相关训练效率达到业界产品的90%以上。
词元星火团队由科大讯飞集团负责星火通用大模型研究、工程、API、产品落地的核心班底组成,团队深耕认知智能研发十余年,长期围绕通用大模型底层技术攻关,先后研发讯飞星火通用大模型系列版本、星火MaaS大模型平台,推进星火大模型在教育、医疗、安全、央国企等领域实现产业化落地,具备扎实的全链条大模型研发与行业落地能力。团队集聚高层次、高水平人才,C9、QS全球百强、985/211院校人员占比超80%,全部为一线核心研发力量。