科大讯飞开源星火X2.5:端侧模型首次原生支持百万Token上下文

科大讯飞开源星火X2.5:端侧模型首次原生支持百万Token上下文

9月1日,科大讯飞子公司讯飞星火(XH Token)推出并开源星火X2.5-4B与星火X2.5-1.7B两款端侧通用大模型。作为端侧模型中首个原生支持最长约100万Token上下文的模型,它把「长文档本地处理」从口号变成可落地的产品能力,面向手机、PC、汽车座舱、机器人与智能家居等离线环境。

端侧百万上下文意味着什么

用户对端侧模型的期待,早已不是「断网能聊几句」,而是一份几十页的产品手册能不能一次读完并提炼重点、一份表格或一条指令驱动的多步骤任务能不能本地完成。星火X2.5给出的答案是:在端侧把百万级信息处理能力带到本地设备,两款模型均采用混合注意力架构,并围绕智能体、代码、数学与指令遵循等核心能力进行优化。

训练与数据底座

模型端到端基于国产算力平台训练,使用约20万亿Token的预训练数据,强调在国产硬件生态上的可部署性。相较单纯比拼榜单,星火X2.5更看重「小模型干大活」的工程边界拓展。

开源与多硬件适配

权重与文档已上线Hugging Face与GitHub,API同步在讯飞星辰MaaS平台开放有限免费窗口。更大旗舰版星火X2.5定于9月7日亮相。在部属层面,两款模型支持英伟达、华为、寒武纪等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio快速部属,并支持使用Llama-Factory进行微调,降低开发者与行业伙伴在不同环境中部属端侧模型的门槛。

核心参数一览

项目 星火X2.5-4B 星火X2.5-1.7B
参数规模 4B 1.7B
原生上下文 最高约100万Token 最高约100万Token
训练数据 约20万亿Token(国产算力) 约20万亿Token(国产算力)
部署场景 手机/PC/座舱/机器人 手机/PC/座舱/机器人
开源地址 Hugging Face + GitHub Hugging Face + GitHub

FAQ

Q1:星火X2.5与之前的端侧模型最大区别是什么?

它原生支持最长约100万Token上下文,可一次读完几十页产品手册并提炼重点,而非仅能做简短对话,把长文档本地处理变成现实能力。

Q2:它能在哪些设备上运行?

面向离线手机、PC、汽车座舱、机器人与智能家居等端侧环境,强调本地完成任务而非依赖云端。

Q3:是否开源,如何部属?

权重与文档已在Hugging Face与GitHub开放;兼容vLLM、SGLang、llama.cpp,可通过Ollama、LM Studio部属,并用Llama-Factory微调。

Q4:更大版本何时发布?

更大旗舰版星火X2.5定于9月7日亮相,值得持续关注其参数规模与多模态能力。

© 版权声明
THE END
喜欢就支持一下吧
点赞5 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容