阶跃星辰Step 5 Preview发布,主攻AI编程与金融场景

    发布时间:2026-09-21 04:00 更新时间:2026-09-21 04:00 阅读量:0

    9月下旬,阶跃星辰对外发布新一代旗舰基座模型 Step 5 Preview,官方给出的定位非常明确:主攻 AI 编程、软件工程、专业知识工作以及金融等高价值场景。按照素材中的说法,该模型将于 10 月 15 日开源,具体协议与权重细节还需要以官方仓库为准。

    600B 总参数、27B 激活,稀疏 MoE 再往前一步

    从架构上看,Step 5 Preview 采用稀疏 MoE(混合专家)设计,总参数 600B,但每次推理实际激活的参数只有 27B。这种“大盘子、小激活”的思路近两年在国产模型里出现得越来越频繁,好处是既保留了模型容量,又把单次推理的算力开销压了下来,对推理集群的成本控制更友好。

    上下文能力是这次发布里比较突出的一个点:模型支持 100 万词元(1M) 的上下文长度,并原生支持文本与视觉输入。对于需要在一次会话里塞进整份代码仓库、几十页合同或长报表的编程与金融场景,长上下文基本算是“入场券”。

    主攻编程与金融,成本是被反复强调的一项

    阶跃星辰给 Step 5 Preview 划定的重点方向,是 AI 编程、软件工程、专业知识工作和金融。这几个场景的共同点是任务链条长、对准确性和可验证性要求高,也更愿意为效果付费。素材中提到,该模型在全球权威榜单 AA 综合智能指数中跻身全球开源前三,单任务成本仅为 Claude Opus 5 的八分之一。榜单名次与成本对比属于厂商披露口径,实际表现仍建议以官方技术报告和自行实测为准。

    把“成本”单独拎出来讲,其实反映了当前国产大模型竞争的一个现实:能力差距在收窄,价格与单位任务成本反而成了企业选型时最先被问到的问题。对做 Agent、批量代码审查、文档处理的团队来说,单任务成本降下来,才谈得上把调用量真正跑起来。

    轻量化与国产算力,是同一根线上的两件事

    把 Step 5 Preview 放进 9 月这一波发布里看,脉络会更清楚。同一时间段里,中国电信开源了星辰 Xing4.0-29B-A4B,29B 总参数、4B 激活,4-bit 量化后显存约 15GB,消费级显卡就能本地跑;智谱的 GLM-5.3-FlashX 则强调基于国产芯片推理算力。激活参数越来越小、量化越来越普遍、国产芯片适配被反复提及,这几件事指向的是同一个目标——让大模型跑得动、跑得起。

    对站长和运维同学来说,这类模型的实际意义在于部署门槛。以往百亿级以上模型基本离不开多卡服务器,现在部分轻量版本已经能在单张消费级显卡上试跑,做本地知识库、代码助手、站内智能问答的可行性明显提高。当然,600B 总参数的旗舰模型仍然需要正经的推理集群,选型时不要只看激活参数。

    后续值得留意的,一是 10 月 15 日开源后放出的权重与许可条款,二是它在真实编程任务上的表现是否撑得住“主攻 AI 编程”这个定位。相关信息以阶跃星辰官方渠道发布为准。

    继续阅读

    📑 📅
    DeepSeek筹备科创板IPO,V4.1 Flash同步发布 2026-09-21
    中国电信开源星辰Xing4.0:29B智能体模型可在消费级显卡本地跑 2026-09-21
    50亿美元融资落地,智谱上调年末ARR指引至30亿美元 2026-09-21
    中电信开源星辰Xing4.0,29B轻量代码智能体 2026-09-20
    工信部印发十五五电子信息制造业规划,AI硬件底座成重点 2026-09-20
    华为昇腾950智算集群9月30日商用,国产算力再进一步 2026-09-21
    智谱完成约50亿美元融资,国产大模型算力与智能体齐头并进 2026-09-22
    中国电信开源Xing4.0-29B,全栈国产轻量级智能体模型 2026-09-22
    国产AI芯片半年营收翻倍,算力政策密集落地 2026-09-22
    阶跃星辰Step 5 Preview亮相,10月开源完整权重 2026-09-22