发布时间:2026-09-09 08:45 更新时间:2026-09-09 08:45 阅读量:1
9月的国产大模型领域迎来一波密集更新,科大讯飞的动作尤其受到关注。月初,讯飞开源了星火X2.5的端侧版本,随后又发布了旗舰级模型,一条覆盖轻量端侧与大规模训练的产品线浮出水面。对于做AI应用选型的站长和开发者来说,这两次发布值得留意。
据多家媒体报道,9月1日科大讯飞开源了星火X2.5-4B和1.7B两款端侧模型,相关权重已上传至Hugging Face和GitHub仓库。这两个参数规模不大的模型,原生支持100万Token上下文,在端侧场景下能处理长文档、长对话,减少了以往需要频繁切片的麻烦。模型采用混合注意力架构,针对智能体、代码、数学等场景做了专门优化,官方称更适合在手机、PC等本地设备上跑推理。
端侧模型对上下文长度的追赶,反映了大模型竞争从“拼参数”转向“拼实用”。在此之前,百万Token上下文多集中在云端大参数模型上,端侧设备受制于内存和算力,往往只能接受较短输入。星火X2.5端侧版本的做法,相当于把小模型的能力边界向外推了一大截。开发者如果要验证效果,可以直接从开源平台下载权重,在本地环境跑一下长文本任务。
紧接着在9月7日,讯飞正式发布旗舰版星火X2.5。公开信息显示,这款模型采用MoE(混合专家)架构,参数规模为293B-A30B,也就是总参数接近3000亿,激活参数约300亿,运行门槛比全量稠密模型低不少。官方介绍中,其重点提升的是代码生成与智能体任务执行能力,并且整个训练和推理基于全国产算力完成。对关注供应链安全的用户而言,这算是一个信号:国产大模型不再只依赖海外GPU集群。
另外,星火X2.5的API已上线讯飞星辰MaaS平台,部分渠道显示可限时免费调用。不过具体免费额度、适用时段,建议以讯飞官方页面和最新公告为准。
从这两次发布可以看出,讯飞走的是“一大一小”双线策略:端侧小模型满足隐私、离线、低成本场景,旗舰大模型主攻云端复杂任务。再加上开源协议的加持,第三方开发者可以基于这些权重做二次开发或私有化部署。对于做建站或运维的团队,如果正在评估引入AI能力,与其纠结选哪家,不如先下载开源版本做一轮基准测试,重点看长上下文下的响应速度与资源占用是否匹配自己的服务器环境。
| 📑 | 📅 |
|---|---|
| 千问办公上线"多人工作台":最高支持百人实时协作,国产AI办公竞赛再升温 | 2026-09-08 |
| 月之暗面被曝秘密递交港股上市申请:目标募资30亿美元,估值剑指500亿 | 2026-09-08 |
| 阿里千问开源自动驾驶视觉语言模型Qwen-Drive:统一感知、问答与规划 | 2026-09-07 |
| 国内首款AI辅助创新药艾普司韦获批:DEL技术沉淀34年终落地 | 2026-09-07 |
| 卧安机器人更新招股书:2025上半年扭亏为盈,冲刺“AI家庭机器人第一股” | 2025-12-10 |
| 腾讯混元开源Hy4 preview:770B参数主攻生产力场景 | 2026-09-09 |
| AI大模型融资竞赛升温 字节阿里等密集输血 | 2026-09-09 |
| 信息通信业“十五五”规划:2030年智能算力目标9800 EFLOPS | 2026-09-09 |
| DeepSeek双线推进:V4.1 Flash发布与科创板IPO筹备 | 2026-09-10 |
| 科大讯飞星火X2.5系列落地,端侧大模型支持百万Token上下文 | 2026-09-10 |