阶跃Step 5 Preview发布:6000亿参数稀疏MoE瞄准编程与金融

    发布时间:2026-09-24 04:01 更新时间:2026-09-24 04:01 阅读量:0

    9月20日,阶跃星辰对外发布新一代大模型 Step 5 Preview。按照官方披露的信息,这是一款采用稀疏 MoE(混合专家)架构的模型,总参数量达到 6000 亿,但每次推理实际激活的参数只有 270 亿,并支持 100 万词元级别的上下文长度。对于关注国产大模型走向的站长和开发者来说,这次发布值得留意的点有两个:一是“大参数、小激活”的路线在国产模型里越来越常见,二是它把重心明确放在了编程、软件工程和金融等专业场景上,而不是泛泛的日常问答。

    参数规模与开源节奏

    从公开数据看,Step 5 Preview 在 Artificial Analysis 综合智能指数上取得 44 分,按阶跃星辰的说法位居全球开源模型前三,单任务成本约为美国旗舰模型的八分之一。需要说明的是,这类榜单分数会随评测版本和模型迭代变化,具体排名以官方公告和榜单当期结果为准。更值得关注的是开源安排:官方表示将在 10 月 15 日全面开源完整权重,目前阶段先开放第三方接口供开发者试用。也就是说,现在能拿到的是 API 形式的预览能力,真正可下载部署的权重还要等一个月左右。

    对中小站长而言,这种“先接口、后权重”的节奏其实比较友好。前期可以先用接口验证业务场景是否匹配,比如把模型接进代码补全、工单分类或金融问答的流程里跑一轮,确认效果和调用成本之后再决定要不要自建推理环境。毕竟 6000 亿总参数的模型即便激活参数不高,完整权重对显存和部署工具链的要求依然不低,具体硬件门槛建议以官方开源页面公布的说明为准。

    场景定位与部署建议

    阶跃方面把 Step 5 Preview 的重点场景列为 AI 编程、软件工程、专业知识工作和金融,并提到在金融基准测试中位列全球第二。这类定位意味着它更适合承担有一定专业门槛的任务,而不是单纯的闲聊。如果你打算在自己的站点或内部系统里做接入测试,可以先从一个小接口验证连通性,例如用 curl 发一条最简单的请求:

    curl -X POST https://api.example.com/v1/chat/completions \
      -H "Authorization: Bearer $API_KEY" \
      -H "Content-Type: application/json" \
      -d '{
        "model": "step-5-preview",
        "messages": [{"role": "user", "content": "用一句话解释什么是MoE架构"}]
      }'

    上面的接口地址、模型名和鉴权方式都是占位示例,实际调用时请替换为阶跃星辰官方文档给出的 endpoint、模型标识和密钥。测试阶段建议单独申请一个 API Key,并在网关层做好调用量统计和费用告警,避免预览接口被意外刷量。

    从行业角度看,稀疏 MoE 加小激活参数已经成为今年国产开源模型的一条主线,目的很直接:在有限算力下把可用能力做上去。阶跃这次把开源时间点放在 10 月中旬,也给开发者和运维留出了评估窗口。后续权重真正放出后,本地部署的显存占用、量化方案和推理框架支持情况,才是决定它能否在中小团队落地的关键,这部分信息目前尚未完全公开,建议持续关注官方发布。

    继续阅读

    📑 📅
    国产AI芯片份额逼近五成,算力产业进入新阶段 2026-09-24
    智谱完成约50亿美元融资,六成投向下一代模型 2026-09-24
    9月国产手机端侧大模型备案新增三款 2026-09-24
    9月国产大模型开源潮:从MoE到全栈国产 2026-09-24
    阶跃星辰Step 5 Preview发布,6000亿参数瞄准AI编程 2026-09-23
    国产大模型9月密集开源:轻量化与全栈国产化成主线 2026-09-25
    智谱完成约50亿美元融资,六成投向下一代模型 2026-09-25
    硅基流动年内累计融资近29亿,推理算力赛道升温 2026-09-25
    超衍智能获近4亿天使融资,押注自进化大模型 2026-09-25
    全国产10万卡AI超集群投用,国产算力走到哪一步 2026-09-25