【区角快讯】9月1日,科大讯飞旗下全资子公司词元星火正式对外发布并开源了星火X2.5-4B与星火X2.5-1.7B两款端侧通用大模型。值得注意的是,这也是当前端侧模型领域中,首个原生支持长达100万Token上下文窗口的产品系列。这两款模型采用了混合注意力架构,重点针对智能体交互、代码编写、数学推理以及指令遵循等核心能力进行了深度优化。在综合实测中,其相关性能表现已领先于业界同尺寸的一流开源模型。
在上下文处理能力上,星火X2.5系列利用覆盖长篇文档及技术资料等场景的千亿级Token高质量数据完成训练。这种原生支持的百万Token窗口,使得模型能够在单次任务中接收并理解规模更为庞大的信息集合。百万级上下文真正解决的核心痛点,在于让模型能够基于完整的信息全貌,在连续的交互过程中持续地理解并处理复杂问题。以产品售后服务为例,用户可以将完整的售后手册导入星火X2.5-4B,模型会先梳理不同场景下的售后规则并标注对应章节。当被问及“购买10天后设备故障且使用过第三方耗材是否符合换货要求”时,它能够关联退换货、故障处理和例外条件等跨章节规定,从而给出综合判断。即便面对偏远地区配送、设备存有家庭地图等新增条件,模型也能保持前文情境,结合物流、数据清除、费用承担和处理时限等规则提供后续建议。
长上下文解决的是信息能否看全的问题,而智能体和工具调用能力解决的则是看完之后能否动手执行。星火X2.5端侧模型可面向个人办公、代码开发、智能硬件和机器人等场景,提供本地化的智能能力。例如在代码开发场景中,星火X2.5-4B在算法实现、代码补全与生成等任务中,可对标参数规模大2至3倍的云端模型,代码编写、脚本生成和调试辅助工作可以不出本地直接完成。在智能硬件场景中,于Domux智能家居测试集上,星火X2.5-1.7B的控制指令端到端执行正确率达到90.3%,平均响应时间仅0.85秒。在机器人场景方面,两款模型可部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。
星火X2.5-4B和1.7B均基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习持续提升推理、代码、智能体和指令遵循等任务表现。部署层面支持NVIDIA、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署,并支持使用LLaMA-Factory开展增量训练。即日起,星火X2.5-4B和1.7B已在Hugging Face、GitHub等平台开放模型权重、代码仓库和部署文档,对应模型API已上线讯飞星辰MaaS平台,限时免费。此外在9月7日,科大讯飞还将正式发布全新一代旗舰通用大模型星火X2.5,进一步升级代码和智能体等核心能力。
科大讯飞开源两款端侧大模型,原生支持百万Token上下文
科技区角
2026-09-01 14:00
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。