发布时间:2026-09-23 04:00 更新时间:2026-09-23 04:00 阅读量:0
9月22日,小米发布了新一代大模型 MiMo-V2.6,一次性推出 Pro 与 Flash 两个版本,均为原生全模态模型,支持文本、图像、视频、音频四种模态的输入与理解。据公开信息,MiMo-V2.6 系列的 AA 综合智能指数达到 46 分,超过 Kimi K3 的 44 分和 GLM-5.3 的 45 分,成为当前 AA 指数排名最高的开源权重模型。
值得一提的是,上一代 MiMo-V2.5-Pro 的 AA 指数仅为 26 分,本次提升幅度达到 20 分,跨度相当可观。官方信息显示,这一代模型在训练阶段探索了 RSI(递归自我改进)路径,强化学习环节的算力投入较大,其中 Pro 版本约 262 万美元,Flash 版本约 85 万美元。具体训练细节与技术报告,建议以官方发布为准。
从命名就能看出,MiMo-V2.6 采取了 Pro 与 Flash 双线并行的思路。Pro 面向复杂推理和高质量生成场景,Flash 主打响应速度与调用成本。定价方面延续了小米一贯的低价路线:Flash 输入 1 元/百万词元、输出 2 元/百万词元;Pro 输入 3 元、输出 6 元。按素材中的对比口径,这一价格约为部分海外模型的 1/20 至 1/60,对中小开发者和建站团队来说,试错门槛被压得很低。
对于站长群体而言,这类定价结构意味着把大模型接入网站客服、内容摘要、图片理解等模块时,单次调用的成本可以被控制在较小的量级。当然,实际费用还与调用量、并发和上下文长度有关,建议在正式上线前用官方提供的计费工具做一次估算。
把 MiMo-V2.6 放到 9 月的时间线上看,国产开源模型的节奏明显加快。9月17日,中国电信发布星辰 Xing4.0-29B-A4B,采用 MoE 架构,总参 29B、激活 4B,原生 256K 上下文并可扩展至 512K,4-bit 量化后显存约 15GB,RTX 3090/4090 这类消费级显卡即可本地运行。9月20日,阶跃星辰发布 Step 5 Preview,总参 6000 亿、激活 270 亿,支持 100 万词元上下文,AA 指数 44 分,并计划在 10月15日全面开源完整权重。
可以看出几个共同趋势:一是「以小博大」,用更少的激活参数换取更高的有效性能;二是原生多模态成为新发布模型的标配,而不是后期拼接;三是开源权重与国产算力芯片的适配节奏在加快。对建站和运维人员来说,模型选择变多意味着可以根据预算和部署条件灵活组合——预算有限、数据敏感的场景可以优先考虑本地部署的小激活模型,追求效果的场景则可以调用云端 API。
需要提醒的是,各家公布的评测分数多基于特定测试集,实际业务表现会因提示词、数据分布和工程实现而不同。选型时不妨先用真实业务样本做一轮小规模对比测试,再决定是否长期接入。
| 📑 | 📅 |
|---|---|
| 智谱完成约50亿美元融资,年末ARR指引上调至30亿美元 | 2026-09-23 |
| 国产AI芯片份额过半,昇腾超节点与万卡集群加速落地 | 2026-09-23 |
| 度小满原力AI平台开放,员工已自建350多个智能体 | 2026-09-22 |
| 阶跃星辰Step 5 Preview亮相,10月开源完整权重 | 2026-09-22 |
| 国产AI芯片半年营收翻倍,算力政策密集落地 | 2026-09-22 |
| 中国电信开源Xing4.0-29B轻量智能体大模型 | 2026-09-23 |
| 阶跃星辰Step 5 Preview发布,6000亿参数瞄准AI编程 | 2026-09-23 |
| 9月国产大模型开源潮:从MoE到全栈国产 | 2026-09-24 |
| 9月国产手机端侧大模型备案新增三款 | 2026-09-24 |
| 智谱完成约50亿美元融资,六成投向下一代模型 | 2026-09-24 |