发布时间:2026-09-15 12:30 更新时间:2026-09-15 12:30 阅读量:0
刚刚过去的两个月,国产大模型的更新节奏明显加快。从科大讯飞、智谱到腾讯混元、面壁智能,多家厂商接连开源新模型,发布时间集中在8月下旬到9月上旬。对关注AI技术走向的站长和开发者来说,这一轮开源潮透露出的信号比单个模型本身更值得琢磨。
9月1日,科大讯飞开源星火X2.5-4B与1.7B两款端侧模型,官方资料显示其原生支持最长100万Token上下文,基于全国产算力平台训练,预训练数据约20万亿Token,采用Apache-2.0协议,允许免费商用。其中1.7B版本BF16权重仅3GB多,4bit量化后体积进一步减半,普通手机即可运行。9月7日,讯飞又发布了旗舰版本星火X2.5-293B。
智谱在8月26日开源GLM-5.3-Flash,这是GLM-5系列首个原生多模态模型,规格为320B-A18B,全部由国产芯片提供算力。发布前该模型以匿名形式参与测试,成为当周较受欢迎的模型之一。腾讯混元8月28日推出Hy4 preview,总参数770B、激活49B,上下文突破1M。面壁智能9月8日发布MiniCPM5-2B,定位2B高密度端侧模型,初步具备端侧通用Agent能力。此外,腾讯EVIE-8B/4.5B、蚂蚁Ling-3.0-flash-VL等也在同期开放。
把这几款模型放在一起看,有两个共同点比较明显。一是旗舰模型集体采用稀疏MoE架构,总参数做到万亿级,但实际激活的只有千亿上下,用较低的激活成本换取接近旗舰的能力。二是竞争标尺正在从参数量转向智能密度——谁能以足够低的成本把AI跑进真实业务场景,谁就更有优势。
训练范式也在变化。有分析指出,部分模型仅靠后训练就能让编程能力明显提升,迭代周期从过去的半年压缩到一两个月。开源矩阵逐渐分层:万亿级MoE面向大型集团的复杂业务,10B级稠密或全模态基座适合PC与终端本地部署,轻量化模型则服务于办公智能体和自动化场景。
与模型开源同步的是调用量的增长。据公开数据,2026年6月我国日均词元调用量接近175万亿,规模居全球前列。定价也在下探,Qwen3.8-Flash低至1元/百万词元,星火X2.5多语言版为1.6元。对于需要把AI接入网站客服、内容生成或数据处理的站长来说,这意味着试错成本在降低。
需要提醒的是,端侧模型的实际表现与硬件、量化方式、推理框架都有关系,部署前建议在自己的设备上实测。模型权重、许可条款和调用价格可能随时调整,具体以各厂商官方公告和模型仓库页面为准。
| 📑 | 📅 |
|---|---|
| 电子信息制造业十五五规划发布,端侧AI芯片与存算一体成重点 | 2026-09-15 |
| 科大讯飞星火X2.5端侧模型开源:小模型也能扛百万上下文 | 2026-09-15 |
| 智谱完成约50亿美元融资,加码GLM自训练 | 2026-09-15 |
| 月之暗面递表港交所,Kimi K2.8 Preview全量上线 | 2026-09-13 |
| AI智能体从对话走向干活,外滩大会与服贸会看点 | 2026-09-13 |
| 百度智能云发布超级智能体全家桶,AI从生成走向执行 | 2026-09-15 |
| 智谱完成约50亿美元融资,GLM模型与算力建设加码 | 2026-09-16 |
| 电子信息制造业十五五规划发布,AI芯片攻关路线明确 | 2026-09-16 |
| 科大讯飞星火X2.5端侧模型开源,支持百万级上下文 | 2026-09-16 |
| 美团龙猫2.0亮相服贸会,万亿参数跑通国产算力 | 2026-09-16 |