
大皖新闻讯 大模型正在加速进入手机、PC、汽车座舱、智能家居和机器人等终端设备。大家对端侧模型的期待,早已不是“断网能聊几句”,而是:一份几十页的产品手册能不能一次读完并提炼重点?一张表格、一项指令、一个多步骤任务,能不能直接完成? 9月1日,总部位于合肥高新区的科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。作为端侧模型中首个原生支持最长100万Token上下文的模型,星火X2.5-4B和1.7B把百万级信息处理能力带到本地设备,拓展中小底座的能力和应用边界。
支持百万级上下文,读懂完整信息
股票杠杆配资入门真实工作场景里,用户交给模型的往往不是一段提问,而可能是一份售后手册、一套会议材料、一批项目文档,甚至是完整代码仓库。
过去,端侧模型处理长内容,常常要把文档切成几段分别问,容易忘记前情、遗漏信息、已读乱回。星火X2.5-4B和1.7B原生支持最长100万Token上下文窗口,使用覆盖长篇文档、技术资料等场景的千亿Token级高质量数据开展训练,可以在一次任务中接收和理解更大规模的信息。
以产品售后为例,用户可将完整的产品售后手册导入星火X2.5-4B,先梳理不同场景下的售后规则并标注对应章节。当进一步询问“购买10天后设备故障,且使用过第三方耗材,是否符合换货要求”时,模型能够关联退换货、故障处理和例外条件等跨章节规定,给出综合判断。面对偏远地区、设备存有家庭地图等新增条件,模型还可保持前文情境,结合物流、数据清除、费用承担和处理时限等规则,提供后续建议。
业内人士分析,百万级上下文并非单纯为了“塞下更多字”,而是让模型基于完整信息,在连续交互中持续理解和处理复杂问题。 目前,星火X2.5端侧模型可面向个人办公、代码开发、智能硬件和机器人等场景,提供本地化智能能力。比如,在代码开发场景中,星火X2.5-4B在算法实现、代码补全与生成等任务中,可对标参数规模大2至3倍的云端模型。代码编写、脚本生成和调试辅助工作,可以不出本地直接完成。依托端侧部署,模型还具备低延迟、离线使用和代码资产本地化管理等优势。开发者可通过DeepSeek Harness、OpenCode、Codex、Pi等开源Harness,将模型接入本地开发和自动化脚本流程。

扎根全国产算力 实现安全可控
大模型进入更多行业和智能终端,既需要模型能力持续提升,也需要自主可控的算力支撑与灵活易用的部署条件。
据了解,星火X2.5-4B和1.7B基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习训练,持续提升模型在推理、代码、智能体和指令遵循等任务中的表现。全国产算力训练,为端侧智能构建了自主、可持续演进的技术底座。在部署层面,两款模型支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署,并支持使用LLaMA-Factory开展增量训练。
据了解,即日起,星火X2.5-4B和1.7B已在Hugging Face、GitHub等平台开放模型权重、代码仓库和部署文档,对应模型API也已上线到讯飞星辰 MaaS平台。
大皖新闻记者 项磊2026年配资平台怎么选
配资行情网提示:本文来自互联网,不代表本网站观点。