发布时间:2026-09-10 04:01 更新时间:2026-09-10 04:01 阅读量:0
9月伊始,国产大模型在端侧与旗舰两条线上同步提速。科大讯飞旗下词元星火先后带来星火X2.5系列的新进展:先是在9月1日开源两款端侧模型,又在9月7日发布旗舰版,引发开发者与站长群体关注。
据介绍,此次开源的星火X2.5-4B和星火X2.5-1.7B属于端侧模型,官方称其原生支持最长100万Token上下文,并采用混合注意力架构。对于需要在本地运行大模型的站长来说,这意味着较长的网页内容、日志或文档可以直接在本地设备上完成分析,不必总是依赖云端接口。
在训练层面,这两款模型基于全国产算力完成全流程训练,预训练数据规模约20万亿Token。推理部署方面,模型支持英伟达、华为、海光等硬件平台,同时兼容vLLM、SGLang、llama.cpp、Ollama等主流推理框架。从实操角度看,本地部署门槛有所降低,具体硬件配置要求仍以官方文档为准。
在端侧模型开源一周后,科大讯飞于9月7日正式发布星火X2.5旗舰版本。该版本采用MoE架构,总参数规模达293B,激活参数为30B。按照官方说法,新版本重点提升了代码生成与智能体执行能力,同时强化了数学推理等场景表现。
从行业节奏看,端侧大模型的长上下文支持和国产算力适配,正在成为多条产品线的共同方向。对于运维人员和建站用户而言,这类模型若能在本地流畅运行,有助于降低数据外溢风险,也能在网络受限环境中维持基础AI能力。不过,模型在具体业务中的效果仍依赖实际测试,建议先在小流量场景中验证。
此次星火X2.5系列的开源与发布,是国内大模型生态走向多样化的一步。后续模型权重、使用文档与部署脚本,可留意科大讯飞官方渠道更新。
| 📑 | 📅 |
|---|---|
| DeepSeek双线推进:V4.1 Flash发布与科创板IPO筹备 | 2026-09-10 |
| 信息通信业“十五五”规划:2030年智能算力目标9800 EFLOPS | 2026-09-09 |
| AI大模型融资竞赛升温 字节阿里等密集输血 | 2026-09-09 |
| 腾讯混元开源Hy4 preview:770B参数主攻生产力场景 | 2026-09-09 |
| 讯飞发布星火X2.5系列,端侧模型支持百万Token上下文 | 2026-09-09 |
| 京东云拟建10万卡国产GPU集群,摩尔线程提供算力底座 | 2026-09-10 |
| 腾讯混元Hy4 preview开源:770B参数与百万级上下文 | 2026-09-10 |
| 工信部十五五规划:有序部署万卡级智算集群 | 2026-09-10 |
| 十万卡集群写进“十五五”,国产算力基建加速 | 2026-09-11 |
| 国产端侧小模型密集开源,智能密度成新战场 | 2026-09-11 |