端侧首个支持百万上下文模型开源 让小模型干大活利好

2026-09-02 09:22:02
分享
AIME

问财摘要

1、词元星火推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型,支持最长100万Token上下文,能够处理复杂问题。星火X2.5-4B在代码开发场景中可对标参数规模大2至3倍的云端模型。 2、星火X2.5-4B和1.7B同样适用于机器人等需要持续感知和连续执行的场景,减少对云端连接和固定预设程序的依赖。 3、两款模型基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架。
免责声明 内容由AI生成
文章提及标的
科大讯飞--
英伟达--
查看股票机会下载客户端

中国日报9月2日电(记者马思)9月1日,科大讯飞(002230)全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。作为端侧模型中首个原生支持最长100万Token上下文的模型,星火X2.5-4B和1.7B把百万级信息处理能力带到了本地设备。两款模型采用混合注意力架构,并围绕智能体、代码、数学和指令遵循等核心能力进行优化。

过去,端侧模型在处理长内容时,常常要把文档切成几段分别处理,容易导致忘记前情、遗漏信息。

星火X2.5-4B基准测试成绩

星火X2.5-4B和1.7B原生支持百万级上下文并非单纯为了“塞下更多字”,而是为了能够让模型基于完整信息,在连续交互中持续理解和处理复杂问题。长上下文解决的是“信息能不能看全”,智能体和工具调用能力解决的则是“看完之后能不能动手”。依托科大讯飞(002230)在AI技术研发、智能办公和智能硬件等领域的积累,星火X2.5端侧模型可面向个人办公、代码开发、智能硬件和机器人等场景,提供本地化智能能力。

在个人办公场景中,星火X2.5端侧模型可覆盖数据处理、文档生成和文档翻译等环节;在代码开发场景中,星火X2.5-4B在算法实现、代码补全与生成等任务中,可对标参数规模大2至3倍的云端模型,开发者可通过DeepSeek Harness、OpenCode、Codex、Pi等开源Harness,将模型接入本地开发和自动化脚本流程。

星火X2.5-4B和1.7B同样适用于机器人等需要持续感知和连续执行的场景。模型可以部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。

推动大模型进入更多行业和智能终端,既需要模型能力持续提升,也需要自主可控的算力支撑与灵活易用的部署条件。

星火X2.5-4B和1.7B基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习训练,持续提升模型在推理、代码、智能体和指令遵循等任务中的表现。

在部署层面,两款模型支持英伟达(NVDA)、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署,并支持使用LLaMA-Factory开展增量训练。多硬件、多框架适配,进一步降低了开发者和行业伙伴在不同环境中部署、微调和应用端侧模型的门槛。

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME