腾讯混元Hy4 preview开源:770B参数与百万级上下文

    发布时间:2026-09-10 04:02 更新时间:2026-09-10 04:02 阅读量:0

    8月28日,腾讯混元正式开源新一代大语言模型Hy4 preview。据公开信息,这是一款采用混合专家架构的大模型,总参数规模达770B,激活参数为49B,上下文长度突破1M Token。模型对外定位为“为生产力而生”,在代码编写、办公协作和科学任务等场景上做了针对性优化。

    长上下文与高效推理成看点

    与当前不少国产开源模型相比,Hy4 preview的亮点之一是把上下文窗口拉长到百万级。更长的上下文意味着模型可以在一次交互中处理更厚的技术文档、完整的项目代码库或是长篇幅的研究报告,减少多轮拼接带来的信息损耗。与此同时,激活参数控制在49B,兼顾了模型能力与推理时的算力开销,适合企业用户在私有化部署或云端调用中做成本控制与性能平衡。

    按照腾讯方面披露的信息,Hy4 preview已适配主流的开源推理框架,开发者可以直接从官方仓库获取权重并部署测试。具体的硬件需求、许可条款和运行环境要求,建议以腾讯混元官方文档和发布说明为准。

    开源生态与应用布局同步推进

    在开源大模型的同时,腾讯近期也在AI应用侧动作频频。例如面向办公场景推出了WorkBuddy开放平台,并在腾讯文档中上线了AI工作台。这些产品未来是否会接入Hy4 preview相关能力,目前还没有官方确认。从行业趋势看,大厂将旗舰模型开源、再通过上层应用和云服务实现商业化,已经成为比较常见的路径。

    需要注意的是,Hy4 preview目前以“preview”命名,通常意味着模型仍在快速迭代阶段。开发者在生产环境大规模接入前,建议先跑通评测集和业务压测,持续关注官方后续版本更新。总体来看,腾讯混元此次开源,让国产大模型在长上下文和参数规模上又多了一个可对比、可实测的选择。

    继续阅读

    📑 📅
    京东云拟建10万卡国产GPU集群,摩尔线程提供算力底座 2026-09-10
    科大讯飞星火X2.5系列落地,端侧大模型支持百万Token上下文 2026-09-10
    DeepSeek双线推进:V4.1 Flash发布与科创板IPO筹备 2026-09-10
    信息通信业“十五五”规划:2030年智能算力目标9800 EFLOPS 2026-09-09
    AI大模型融资竞赛升温 字节阿里等密集输血 2026-09-09
    工信部十五五规划:有序部署万卡级智算集群 2026-09-10
    十万卡集群写进“十五五”,国产算力基建加速 2026-09-11
    国产端侧小模型密集开源,智能密度成新战场 2026-09-11
    大模型公司扎堆冲刺IPO,DeepSeek与月之暗面领衔 2026-09-11
    智能体集中上线,国内AI从办公桌走进家庭与车间 2026-09-11