星火X2.5发布并开源端侧模型,百万上下文下探端侧

    发布时间:2026-09-12 04:02 更新时间:2026-09-12 04:02 阅读量:0

    2026年9月,科大讯飞在模型侧连出两手:一边是9月7日正式发布旗舰模型星火X2.5,采用MoE架构,参数量为293B-A30B,重点提升代码与智能体能力;另一边是更早的9月1日,其全资子公司词元星火推出并开源星火X2.5-4B和1.7B两款端侧通用大模型。据公开报道,训练与推理全流程均基于全国产算力完成。

    旗舰负责能力上限,端侧负责落地半径

    从公开信息看,这两类模型的定位并不重叠。星火X2.5走的是旗舰路线,MoE结构、激活参数约300亿,瞄准的是代码生成、智能体任务编排这些对推理深度要求较高的场景;而4B与1.7B两款端侧模型,目标是把模型塞进算力和内存都有限的终端设备里。

    值得注意的是上下文长度。据报道,星火X2.5-4B与1.7B是端侧模型中较早原生支持最长100万Token上下文的产品,采用混合注意力架构。上下文长度对小模型的意义,往往比对大模型更直接:终端设备上真正需要模型处理的,常常是一份长文档、一段长会议记录、一批设备日志,而不是一两句问答。上下文够长,才有机会在本地完成整份材料的检索与摘要,而不是先切片上传再拼接。

    开放权重潮里的端侧分支

    把这件事放回2026年的整体节奏里,会更清楚。据媒体报道,今年夏秋国产大模型出现了一轮明显的开放权重潮,Kimi K3、MiniMax H3、千问旗舰等接连开放权重。需要厘清的是,这一轮多为开源权重,并不完全等同于开放训练代码与原始数据,各家配套的商业许可条款也有差异,个人研究、中小团队与大企业商用往往适用不同规则。企业若要拿来做产品,建议逐条确认许可协议,具体以官方发布为准。

    端侧这条分支同样热闹。9月面壁智能发布MiniCPM5-2B,定位2B端侧基座,支持512K上下文与混合思考,昆仑芯联合FlagOS完成了Day 0适配;更早还有多家厂商的端侧小模型陆续开源。可以看出,小模型不再只是“缩水版”,而是被当作独立产品线来做。

    站长和运维能拿到什么

    对建站与运维团队来说,端侧小模型的价值不在于替代云端大模型,而在于把一部分高频、低风险、涉密性强的处理留在本地。比较典型的方向包括:服务器日志的批量归类与异常摘要、工单内容的初步分类、内部文档的本地检索前置处理。这类任务对生成质量要求不极端,但对数据不出内网、调用成本可控的要求很高。

    真要动手,建议按三步走。先在测试机上部署量化版本,用自家真实日志跑一轮,看摘要准确率和响应延迟是否可接受;再确定是否需要保留云端兜底,把难度高的请求转出去;最后再谈上线,避免把实验性模型直接放进生产链路。

    硬件门槛方面,4B与1.7B这类体量通常比旗舰模型友好得多,但具体能跑到什么速度、需要多少内存与显存、量化后效果衰减多少,与设备、推理框架、量化方案都强相关,网上流传的“最低配置”参考价值有限。稳妥做法是以官方模型卡和文档说明为准,在目标设备上实测后再下判断。模型权重与许可信息,也建议直接看官方发布渠道。

    继续阅读

    📑 📅
    百度搭子接入小度硬件,AI智能体走进家庭场景 2026-09-12
    可灵AI获14亿元注资,视频生成赛道再受关注 2026-09-12
    十万卡智算集群写入十五五规划,国产算力加速落地 2026-09-12
    DeepSeek V4.1 Flash上线并降价,同步筹备科创板IPO 2026-09-12
    可灵AI获国家人工智能基金14亿元注资,国资加码视频生成 2026-09-11
    国产端侧大模型密集开源,小参数模型开始扛活 2026-09-13
    工信部十五五算力规划落地,十万卡集群提速 2026-09-13
    DeepSeek发布V4.1 Flash,同步筹备科创板IPO 2026-09-13
    AI智能体从对话走向干活,外滩大会与服贸会看点 2026-09-13
    月之暗面递表港交所,Kimi K2.8 Preview全量上线 2026-09-13