发布时间:2026-09-23 04:01 更新时间:2026-09-23 04:01 阅读量:0
9月20日,阶跃星辰对外发布新一代模型 Step 5 Preview。这款模型采用稀疏混合专家(MoE)架构,总参数规模达到6000亿,但单次推理实际激活的参数只有270亿,同时支持100万词元的上下文长度,并原生支持文本与视觉输入。据了解,完整权重计划于10月15日开源,具体开放方式以官方公告为准。
从公开信息看,Step 5 Preview 延续了阶跃星辰近几代模型的设计思路:用较小的激活参数换取接近头部模型的综合能力。在第三方评测机构 Artificial Analysis 的综合智能指数中,该模型拿到44分,位列全球开源模型前三。在成本侧,官方给出的口径是单任务成本约为 Claude Opus 5 的八分之一。
对于站长和运维人员来说,MoE 架构的实际意义在于显存占用与推理成本的平衡。总参数决定模型的知识容量,激活参数决定每次前向计算的开销,这也是近一年国产开源模型普遍采用的技术路线——把有限的算力预算优先投向推理效率和场景适配,而不是单纯堆参数规模。
按照官方披露的方向,Step 5 Preview 的重点落地场景包括 AI 编程、软件工程、金融以及专业知识工作。这几类场景的共同点是对长上下文与工具调用能力要求较高:代码仓库动辄数万行,金融与专业文档也常常超过常规模型的上下文窗口,100万词元的上下文规格正是为这类需求准备的。
如果把这类模型接入自有系统,通常通过兼容 OpenAI 格式的接口调用,下面是一个最简的调用示例,实际地址与参数请以官方文档为准:
curl https://api.example.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $API_KEY" \
-d '{
"model": "step-5-preview",
"messages": [{"role": "user", "content": "帮我审查这段Nginx配置"}],
"max_tokens": 2048
}'需要注意,大上下文并不等于可以无限制塞入内容。上下文越长,首 token 延迟和费用越高,建议在业务侧做好检索增强(RAG)或分段摘要,把真正相关的片段喂给模型,而不是把整份文档直接丢进去。
综合近期动态看,9月国产开源模型密集发布:小米 MiMo-V2.6 推出 Pro 与 Flash 双版本,中国电信开源了 Xing4.0-29B-A4B 轻量智能体模型,阶跃星辰则把 Step 5 Preview 定位在开源阵营的第一梯队。对中小站长而言,这类权重开放意味着可以在自有服务器或私有云上部署,避免数据外流,但也要把硬件成本算清楚:6000亿总参数的模型即便按 MoE 稀疏激活,完整权重加载对显存的要求依然不低。
一个务实的做法是先用 API 验证业务效果,跑通提示词与工作流,再评估是否需要本地化部署。10月15日完整权重开放后,社区大概率会推出量化版本,届时在单机或多卡环境下的可行性会更容易判断。选型时建议同时对比模型在自家真实任务上的表现,评测榜单只能作为参考。
| 📑 | 📅 |
|---|---|
| 中国电信开源Xing4.0-29B轻量智能体大模型 | 2026-09-23 |
| 小米MiMo-V2.6开源双版本发布,全模态模型登顶AA开源榜 | 2026-09-23 |
| 智谱完成约50亿美元融资,年末ARR指引上调至30亿美元 | 2026-09-23 |
| 国产AI芯片份额过半,昇腾超节点与万卡集群加速落地 | 2026-09-23 |
| 度小满原力AI平台开放,员工已自建350多个智能体 | 2026-09-22 |
| 9月国产大模型开源潮:从MoE到全栈国产 | 2026-09-24 |
| 9月国产手机端侧大模型备案新增三款 | 2026-09-24 |
| 智谱完成约50亿美元融资,六成投向下一代模型 | 2026-09-24 |
| 国产AI芯片份额逼近五成,算力产业进入新阶段 | 2026-09-24 |
| 阶跃Step 5 Preview发布:6000亿参数稀疏MoE瞄准编程与金融 | 2026-09-24 |