发布时间:2026-09-24 04:00 更新时间:2026-09-24 04:00 阅读量:0
2026年9月的国产大模型圈,开源动作明显密集起来。从手机厂商到运营商,从初创团队到上市公司,短短三周内至少四款有分量的模型选择开放权重,而且路线出奇地一致:稀疏MoE架构、主打智能体执行能力、强调本地化部署门槛。对关注建站与服务器成本的读者来说,这些变化直接关系到将来能不能用一台带消费级显卡的机器跑起自己的AI应用。
9月22日,小米发布并开源MiMo-V2.6系列,包含Pro与Flash两个版本,均为原生全模态模型,支持图片、视频、音频与文本输入。据公开信息,Pro版在Artificial Analysis智能指数v4.3.2中取得46分,超过Kimi K3的44分与GLM-5.3的45分,成为该指数下排名靠前的开源权重模型。官方披露的训练周期不到六天,Pro版本训练成本约262万美元,技术路线上探索了被称为RSI的递归自我改进方向。定价方面,Flash为每百万词元输入1元、输出2元,Pro为3元与6元,并提供缓存折扣。能力层面提到3D空间推理、多模态感知与计算机操作,甚至包括控制机械臂这类具身场景。
9月20日亮相的阶跃星辰Step 5 Preview采用稀疏MoE架构,总参数量6000亿,激活参数仅270亿,支持100万词元上下文,AA综合智能指数44分,官方称其位列全球开源模型前三,单任务成本约为美国旗舰模型的八分之一,重点场景放在AI编程、软件工程与金融方向。需要留意的是,完整权重计划在10月15日全面开源,目前主要开放第三方接口,具体安排以官方公告为准。
中国电信在9月17日发布星辰Xing4.0-29B-A4B,其特点在于这是国内首个基于国产算力和国产框架完成训练的百亿参数模型,训练使用昇腾平台。模型采用MoE结构,总参数29B、激活参数4B,原生支持256K上下文并可扩展至512K,SuperCLUE智能体能力得分93.52,位列第三。部署门槛是它比较实用的一点:4-bit量化后显存占用约15GB,RTX 3090或4090这类消费级显卡即可本地运行,权重已在GitHub、Hugging Face、Gitee、魔搭等平台开放。
更早的9月1日,科大讯飞开源了星火X2.5-4B与1.7B两款端侧通用模型,原生支持最长100万Token上下文,采用混合注意力架构,面向个人办公、代码开发、智能硬件等本地化场景,API同步上线讯飞星辰MaaS平台。
这一轮开源有三个共性值得记住。其一,MoE稀疏架构加小激活参数成为主流思路,用更少的激活参数换取更低的推理显存占用,这对自建推理服务的站长是实打实的成本下降通道。其二,智能体执行能力取代单纯问答成为卖点,意味着模型更多被用来调用工具、完成任务,而不是只做对话。其三,全栈国产化与轻量化本地部署被反复强调,从芯片到框架的国产链路正在从概念走向可运行状态。需要提醒的是,各模型的量化方案、显存占用与并发表现受硬件、推理框架版本影响较大,实际部署前建议先在测试环境验证,具体参数以官方文档为准。
| 📑 | 📅 |
|---|---|
| 阶跃星辰Step 5 Preview发布,6000亿参数瞄准AI编程 | 2026-09-23 |
| 中国电信开源Xing4.0-29B轻量智能体大模型 | 2026-09-23 |
| 小米MiMo-V2.6开源双版本发布,全模态模型登顶AA开源榜 | 2026-09-23 |
| 智谱完成约50亿美元融资,年末ARR指引上调至30亿美元 | 2026-09-23 |
| 国产AI芯片份额过半,昇腾超节点与万卡集群加速落地 | 2026-09-23 |
| 9月国产手机端侧大模型备案新增三款 | 2026-09-24 |
| 智谱完成约50亿美元融资,六成投向下一代模型 | 2026-09-24 |
| 国产AI芯片份额逼近五成,算力产业进入新阶段 | 2026-09-24 |
| 阶跃Step 5 Preview发布:6000亿参数稀疏MoE瞄准编程与金融 | 2026-09-24 |
| 国产大模型9月密集开源:轻量化与全栈国产化成主线 | 2026-09-25 |