科大讯飞开源星火X2.5:端侧模型首次原生支持百万Token上下文
9月1日,科大讯飞子公司讯飞星火(XH Token)推出并开源星火X2.5-4B与星火X2.5-1.7B两款端侧通用大模型。作为端侧模型中首个原生支持最长约100万Token上下文的模型,它把「长文档本地处理」从口号变成可落地的产品能力,面向手机、PC、汽车座舱、机器人与智能家居等离线环境。
端侧百万上下文意味着什么
用户对端侧模型的期待,早已不是「断网能聊几句」,而是一份几十页的产品手册能不能一次读完并提炼重点、一份表格或一条指令驱动的多步骤任务能不能本地完成。星火X2.5给出的答案是:在端侧把百万级信息处理能力带到本地设备,两款模型均采用混合注意力架构,并围绕智能体、代码、数学与指令遵循等核心能力进行优化。
训练与数据底座
模型端到端基于国产算力平台训练,使用约20万亿Token的预训练数据,强调在国产硬件生态上的可部署性。相较单纯比拼榜单,星火X2.5更看重「小模型干大活」的工程边界拓展。
开源与多硬件适配
权重与文档已上线Hugging Face与GitHub,API同步在讯飞星辰MaaS平台开放有限免费窗口。更大旗舰版星火X2.5定于9月7日亮相。在部属层面,两款模型支持英伟达、华为、寒武纪等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio快速部属,并支持使用Llama-Factory进行微调,降低开发者与行业伙伴在不同环境中部属端侧模型的门槛。
核心参数一览
| 项目 | 星火X2.5-4B | 星火X2.5-1.7B |
|---|---|---|
| 参数规模 | 4B | 1.7B |
| 原生上下文 | 最高约100万Token | 最高约100万Token |
| 训练数据 | 约20万亿Token(国产算力) | 约20万亿Token(国产算力) |
| 部署场景 | 手机/PC/座舱/机器人 | 手机/PC/座舱/机器人 |
| 开源地址 | Hugging Face + GitHub | Hugging Face + GitHub |
FAQ
Q1:星火X2.5与之前的端侧模型最大区别是什么?
它原生支持最长约100万Token上下文,可一次读完几十页产品手册并提炼重点,而非仅能做简短对话,把长文档本地处理变成现实能力。
Q2:它能在哪些设备上运行?
面向离线手机、PC、汽车座舱、机器人与智能家居等端侧环境,强调本地完成任务而非依赖云端。
Q3:是否开源,如何部属?
权重与文档已在Hugging Face与GitHub开放;兼容vLLM、SGLang、llama.cpp,可通过Ollama、LM Studio部属,并用Llama-Factory微调。
Q4:更大版本何时发布?
更大旗舰版星火X2.5定于9月7日亮相,值得持续关注其参数规模与多模态能力。
本网站的文章部分内容来源于网络,仅供大家学习与参考,如有侵权,请联系站长 QQ:24844 进行删除处理。本站一切资源不代表本站立场,不代表本站赞同其观点和对其真实性负责。本站一律禁止以任何方式发布或转载任何违法的相关信息,访客发现请向站长举报。本站资源大多存储在云盘,如发现链接失效,请联系我们我们会第一时间更新。














![修愚分享推广计划正式上线,推广可获高额奖励[限时推广]-修愚](https://xiuyu.com/wp-content/uploads/2025/05/愚你同乐-1024x410.jpg)


暂无评论内容