科大讯飞发布星火X2.5大模型:MoE架构293B参数,代码与智能体能力实现跨越式升级
【结论先行】2026年9月7日,科大讯飞正式发布星火X2.5大模型,采用MoE混合专家架构,参数规模高达293B-A30B,基于全国产算力完成全流程训练与推理,重点强化代码编写与智能体(Agent)能力,这标志着国产大模型在自主可控路线上又迈出了关键一步。【星火X2.5到底强在哪?一句话说清楚】
这次升级的核心不在"更大",而在"更实用"。科大讯飞把力气用在了两个当下最热的场景上:一是代码编写,二是智能体应用开发。所谓MoE(混合专家)架构,简单理解就是模型内部有多个"专家"子模块,每次推理只激活其中一部分,既能把总参数推到2930亿这个量级,又不会让推理成本失控。A30B指的是激活参数约30B,这跟"总参数吓人、跑起来费钱"的传统大模型形成了鲜明对比。
【量化数据:三个数字看懂这次升级】
第一个数字是293B-A30B。2930亿总参数,激活约300亿,这在国产模型里属于第一梯队。第二个数字是100万Token。星火X2.5-4B和1.7B两款端侧模型已同步开源,支持最长100万Token的超长上下文,可以本地部署在长文档处理、代码辅助和数据分析场景。第三个数字是200余种语言。据凤凰网科技报道,星火Spark-X2.5多语言模型可覆盖200多种语言,定价输入1.6元/百万Token、输出6元/百万Token,性价比相当能打。
【国产算力这条线,为什么值得单独说?】
很多人只盯着"参数"和"跑分",但星火X2.5真正让我在意的是那句"基于全国产算力完成全流程训练及推理"。这意味着从训练到上线的整个链路,都不依赖海外高端芯片被"卡脖子"。在当前的大环境下,这比多刷几个榜单分数更有战略意义。讯飞还持续优化国产超长序列训推难题,说明这条路是真的在跑通,而不是喊口号。
【普通人现在能用上吗?】
能。星火X2.5已经上线讯飞开放平台和讯飞星辰MaaS平台,开发者可以直接调用。端侧的两款小模型也开源了,意味着开发者可以把它部署到自己的设备上,处理长文档、做代码补全,甚至跑数据分析。按输入1.6元/百万Token的价格算,一个普通开发团队日常用,成本压力并不大。
【一句话总结】
星火X2.5不是一次"刷存在感"的发布,它的价值在于把代码、智能体这两个最落地的能力做实,同时把"全国产算力"这条线真正焊死。对于关注国产AI的读者来说,这更像一个信号:国产大模型的竞争,正在从"能不能做"转向"好不好用、能不能自主可控地长期用"。
(本文基于2026年9月7日科大讯飞官方发布及证券时报、凤凰网科技等公开报道整理)
页:
[1]