国产大模型9月密集上新:从会聊天到会做事

    发布时间:2026-09-20 04:00 更新时间:2026-09-20 04:00 阅读量:0

    2026年9月的国产大模型赛道显得格外热闹。一边是融资消息接连落地,一边是新模型密集发布,而且这一轮上新有一个共同的关键词:智能体。模型不再只比谁答得好,而是比谁能把任务真正做完。

    9月新模型扎堆,智能体成主打方向

    9月7日,科大讯飞发布星火X2.5,采用MoE架构,参数规模为293B-A30B,重点提升代码与智能体能力,并且基于全国产算力完成全流程训练与推理,已上线讯飞开放平台。据了解,此前星火X2.5的4B与1.7B端侧模型已经开源,支持最长100万Token上下文。

    9月17日,中电信人工智能发布星辰大模型Xing4.0-29B-A4B。这款模型同样采用MoE架构,总参数29B、激活参数仅4B,定位为全栈国产轻量级代码智能体大模型,是国内首个基于国产算力和国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型,已在GitHub、Hugging Face、Gitee、魔搭等社区上线。

    9月中旬,紫东太初开源ZDTaichu5.0-9B多模态大模型,参数量约9B,支持单图、多图、长序列视频及任意分辨率视觉输入,重点提升空间感知、跨视角变换与具身任务规划能力,并同步开放空间多模态数据生产方案。9月8日,基元律动联合无问芯穹等机构发布首个Agent-Native模型NeoHorse-1,包含4B和9B两个版本,把智能体使用工具、接收反馈、修正错误的经验系统化地转化为模型自身能力。

    此外,智谱在9月18日推出GLM-5.3-FlashX,最高速度达200 tokens/s,基于约10万张国产芯片的推理算力,明显加大了推理侧的投入。

    融资向头部集中,资本化节奏加快

    模型密集发布的背后,是资本市场的同步升温。9月13日宣布、9月18日完成的智谱约50亿美元融资,结构上由约20亿美元股份配售加上约30亿美元可转债组成,资金投向下一代GLM模型、完全自训练体系及算力基础设施。公开信息显示,智谱2026年上半年MaaS开放平台及API收入为8.25亿元,占总收入86.5%。

    同月,清华系的自进化基础大模型公司超衍智能完成近4亿元人民币天使系列融资;智象未来完成C+轮融资,并同步发布原生全模态视频生成模型HiDream-O1-Video-1.0;月之暗面则被曝以保密形式向港交所递交A1文件,启动港股IPO进程,公司回应不予置评。可以看到,国资背景产业资本在早期与产业轮次中颇为活跃。

    开源与国产算力互相成就

    把这几条消息放在一起看,一个趋势很清楚:开源与国产算力正在互相成就。星辰Xing4.0强调全栈国产训练,GLM-5.3-FlashX把推理跑在国产芯片上,紫东太初一边开源模型一边开放数据生产方案。对站长和中小团队来说,这意味着可选的国产模型底座在变多,部署门槛也在下降——部分轻量模型在量化后已经能在消费级显卡上本地运行,具体支持情况以官方文档为准。

    从产业视角看,2026年国内大模型的竞争重心正从参数规模转向任务完成能力。模型能不能调工具、能不能在长流程里自己纠错,正在成为新的分水岭。对做网站、做应用的人来说,这或许是接入AI能力成本相对友好的一个时间窗口。

    继续阅读

    📑 📅
    智象未来发布全模态视频模型并完成C+轮融资 2026-09-19
    国产AI芯片算力迎政策窗口,数据中心国产化提速 2026-09-19
    月之暗面递交港股A1文件,国产大模型IPO竞赛提速 2026-09-19
    超衍智能获近4亿天使融资,自进化大模型受关注 2026-09-19
    智谱完成约50亿美元融资,国产大模型进入周抛节奏 2026-09-19
    智谱完成约50亿美元融资,投向下一代GLM 2026-09-20
    国产大模型密集开源,智能体与国产算力成焦点 2026-09-20
    工信部印发十五五电子信息制造业规划,AI硬件底座成重点 2026-09-20
    中电信开源星辰Xing4.0,29B轻量代码智能体 2026-09-20
    50亿美元融资落地,智谱上调年末ARR指引至30亿美元 2026-09-21