阶跃星辰Step 5 Preview发布,6000亿参数MoE跻身开源前三

    发布时间:2026-09-26 04:00 更新时间:2026-09-26 04:00 阅读量:0

    9月20日,上海大模型企业阶跃星辰发布了新一代旗舰基座模型 Step 5 Preview。据公开信息,该模型在 Artificial Analysis 综合智能指数上取得 44 分,位居全球开源模型前三。对于长期关注国产大模型走向的站长和开发者来说,这次发布值得留意的点不只是分数,而是它在架构、上下文长度和成本结构上同时做了取舍。

    6000亿总参数、270亿激活,MoE 成了共同选择

    Step 5 Preview 采用 MoE(混合专家)架构,总参数规模达到 6000 亿,但单次推理实际激活的参数只有 270 亿。这种“大总参、小激活”的思路,是当前国产旗舰模型比较常见的设计取向:把知识容量堆在总参数里,把每次计算量压到激活参数上,从而在效果和推理成本之间找平衡。

    上下文窗口方面,Step 5 Preview 支持 100 万词元。长上下文对建站和运维场景的意义比较直接,比如一次性读入较长的日志、配置说明或多份文档,减少反复切分的麻烦。不过长上下文的实际可用长度、显存占用和延迟表现,通常与具体部署环境关系很大,具体以官方文档和实际测试环境为准。

    成本是这次发布的另一个关键词。据了解,Step 5 Preview 的单任务成本约为美国 Claude Opus 5 的八分之一。金融场景表现相对突出,在 FrontierFinance 评测中位列全球第二。需要说明的是,评测分数和成本测算都来自厂商与第三方机构的公开口径,不同任务、不同调用方式下的实测结果会有差异。

    先预览、后开源,10月15日放出完整权重

    阶跃星辰这次走的是“先发 Preview、再全面开源”的节奏:9月20日发布预览版本,计划在 10 月 15 日全面开源完整权重。对中小站长和独立开发者而言,权重开源意味着可以在自有环境里做私有化部署或二次微调,而不必完全依赖 API 调用。

    如果把时间线拉长一点看,9月的国产大模型赛道相当热闹:小米在 9月22日发布并开源了 MiMo-V2.6 系列,中国电信在 9月17日发布了星辰 Xing4.0-29B,智谱的 GLM-5.3 系列也在持续迭代。这几款模型的共同点是都采用了 MoE 架构,并且都把智能体(Agent)能力作为发力的方向。从“会回答”到“会做事”,正在成为国产模型共同的演进路线。

    对运维和建站用户来说,模型迭代的速度已经明显快于多数业务系统的更新周期。比较务实的做法是:先明确自己的场景是偏文本处理、偏多模态,还是偏长文档分析,再结合显存预算、推理延迟和调用成本去选型,而不是单纯盯着榜单排名。模型权重、许可条款和商用限制,建议以官方仓库和公告为准。

    继续阅读

    📑 📅
    中国电信星辰Xing4.0-29B:全栈国产轻量智能体模型 2026-09-26
    智谱完成约50亿美元融资,GLM-5.3-FlashX同步上线 2026-09-26
    小米开源MiMo-V2.6:全模态大模型登顶开源榜 2026-09-26
    全国产10万卡AI超集群投用,国产算力走到哪一步 2026-09-25
    超衍智能获近4亿天使融资,押注自进化大模型 2026-09-25
    息壤开物两月获数亿元融资,物理AI赛道受关注 2026-09-26
    小米开源MiMo-V2.6,国产模型AA指数登顶 2026-09-27
    智谱完成约50亿美元融资,GLM-5.3-FlashX同步上线 2026-09-27
    中国电信星辰Xing4.0开源,百亿参数跑在消费级显卡上 2026-09-27
    DeepSeek二轮融资落地,估值与上市传闻同步升温 2026-09-27