发布时间:2026-09-20 04:00 更新时间:2026-09-20 04:00 阅读量:0
2026年9月,国产大模型的开源节奏明显加快。从9月上旬到中旬,多款面向智能体、多模态与代码场景的模型陆续开放权重,涉及中国电信、紫东太初、基元律动等团队。与前两年偏重参数规模比拼不同,这一轮发布普遍把国产算力训练和智能体能力放在显眼位置,开源生态与芯片适配正在成为国产大模型的共同底色。
9月17日,中电信人工智能公司发布星辰大模型 Xing4.0-29B-A4B。据公开信息,这款模型采用 MoE 架构,总参数 29B、激活参数仅 4B,是国内首个基于国产算力和国产框架完成训练的百亿参数代码智能体大模型,定位是面向复杂工程任务做深度优化。
轻量化带来的实际收益是部署门槛下降。据了解,该模型在 4-bit 量化后显存占用可降至 15GB 左右,RTX 3090、4090 这类消费级显卡即可本地运行,原生支持 256K 上下文并可扩展至 512K。目前模型已在 GitHub、Hugging Face、Gitee、魔搭等社区上线,具体下载方式与许可条款以官方仓库说明为准。
同一时间段,紫东太初开源了 ZDTaichu5.0-9B 多模态大模型,参数量约 9B,支持单图、多图、长序列视频以及任意分辨率视觉输入,重点提升空间感知、跨视角变换和具身任务规划能力,并同步开放了空间多模态数据生产方案。
智能体方向也有新面孔。9月8日,基元律动联合无问芯穹等机构发布 Agent-Native 模型 NeoHorse-1,包含 4B 和 9B 两个版本,思路是把 Agent 使用工具、接收反馈、修正错误的经验系统化地转化为模型自身能力。此外,面壁的 MiniCPM5-2B 也在9月上旬开源,进一步丰富了小参数模型的选择。
更早一些的6月,智谱上线并开源 GLM-5.2,支持 100 万 tokens 上下文窗口,采用 MIT 许可,可自由下载、部署与商用,上线首日即完成华为昇腾、摩尔线程、寒武纪、昆仑芯等国产算力平台适配。这一做法在9月的新模型中基本延续,发布即适配国产芯片正在变成行业惯例。
对建站和运维人群来说,这一轮开源最直接的价值是可自部署的选项变多了。百亿参数级模型经过量化后能在单张消费级显卡上跑起来,意味着中小团队不必完全依赖云端 API,也能在本地验证智能体、代码补全或文档问答类应用。当然,本地部署涉及驱动、推理框架和显存规划,具体版本兼容性请以模型官方文档和实际环境为准。
需要注意的是,模型开源不等于开箱即用。许可证类型、商用范围、训练数据来源等细节各家不同,落地前建议逐项核对官方仓库的说明。随着国产算力平台适配成为标配,后续选择本地推理硬件时,也可以把生态支持情况纳入考量。
| 📑 | 📅 |
|---|---|
| 智谱完成约50亿美元融资,投向下一代GLM | 2026-09-20 |
| 国产大模型9月密集上新:从会聊天到会做事 | 2026-09-20 |
| 智象未来发布全模态视频模型并完成C+轮融资 | 2026-09-19 |
| 国产AI芯片算力迎政策窗口,数据中心国产化提速 | 2026-09-19 |
| 月之暗面递交港股A1文件,国产大模型IPO竞赛提速 | 2026-09-19 |
| 工信部印发十五五电子信息制造业规划,AI硬件底座成重点 | 2026-09-20 |
| 中电信开源星辰Xing4.0,29B轻量代码智能体 | 2026-09-20 |
| 50亿美元融资落地,智谱上调年末ARR指引至30亿美元 | 2026-09-21 |
| 中国电信开源星辰Xing4.0:29B智能体模型可在消费级显卡本地跑 | 2026-09-21 |
| DeepSeek筹备科创板IPO,V4.1 Flash同步发布 | 2026-09-21 |