9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。
大模型正在加速进入手机、PC、汽车座舱、智能家居和机器人等终端设备。大家对端侧模型的期待,早已不是“断网能聊几句”,而是一份几十页的产品手册能不能一次读完并提炼重点;一张表格、一项指令、一个多步骤任务,能不能直接完成。
星火X2.5给出了答案:作为端侧模型中首个原生支持最长100万Token上下文的模型,星火X2.5-4B和1.7B把百万级信息处理能力带到本地设备。两款模型采用混合注意力架构,并围绕智能体、代码、数学和指令遵循等核心能力进行优化。综合实测,相关能力领先业界同尺寸一流开源模型。
从“能够在设备上对话”,到“能够在本地完成任务”,星火X2.5端侧模型正在拓展中小底座的能力和应用边界。
以产品售后为例,用户可将完整的产品售后手册导入星火X2.5-4B,先梳理不同场景下的售后规则并标注对应章节;当进一步询问“购买10天后设备故障,且使用过第三方耗材,是否符合换货要求”时,模型能够关联退换货、故障处理和例外条件等跨章节规定,给出综合判断。面对偏远地区、设备存有家庭地图等新增条件,模型还可保持前文情境,结合物流、数据清除、费用承担和处理时限等规则,提供后续建议。
依托科大讯飞在AI技术研发、智能办公和智能硬件等领域的积累,星火X2.5端侧模型可面向个人办公、代码开发、智能硬件和机器人等场景,提供本地化智能能力。
在部署层面,两款模型支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署,并支持使用LLaMA-Factory开展增量训练。多硬件、多框架适配,进一步降低了开发者和行业伙伴在不同环境中部署、微调和应用端侧模型的门槛。
南方+记者 郜小平