发布时间:2026-09-10 04:02 更新时间:2026-09-10 04:02 阅读量:0
8月28日,腾讯混元正式开源新一代大语言模型Hy4 preview。据公开信息,这是一款采用混合专家架构的大模型,总参数规模达770B,激活参数为49B,上下文长度突破1M Token。模型对外定位为“为生产力而生”,在代码编写、办公协作和科学任务等场景上做了针对性优化。
与当前不少国产开源模型相比,Hy4 preview的亮点之一是把上下文窗口拉长到百万级。更长的上下文意味着模型可以在一次交互中处理更厚的技术文档、完整的项目代码库或是长篇幅的研究报告,减少多轮拼接带来的信息损耗。与此同时,激活参数控制在49B,兼顾了模型能力与推理时的算力开销,适合企业用户在私有化部署或云端调用中做成本控制与性能平衡。
按照腾讯方面披露的信息,Hy4 preview已适配主流的开源推理框架,开发者可以直接从官方仓库获取权重并部署测试。具体的硬件需求、许可条款和运行环境要求,建议以腾讯混元官方文档和发布说明为准。
在开源大模型的同时,腾讯近期也在AI应用侧动作频频。例如面向办公场景推出了WorkBuddy开放平台,并在腾讯文档中上线了AI工作台。这些产品未来是否会接入Hy4 preview相关能力,目前还没有官方确认。从行业趋势看,大厂将旗舰模型开源、再通过上层应用和云服务实现商业化,已经成为比较常见的路径。
需要注意的是,Hy4 preview目前以“preview”命名,通常意味着模型仍在快速迭代阶段。开发者在生产环境大规模接入前,建议先跑通评测集和业务压测,持续关注官方后续版本更新。总体来看,腾讯混元此次开源,让国产大模型在长上下文和参数规模上又多了一个可对比、可实测的选择。
| 📑 | 📅 |
|---|---|
| 京东云拟建10万卡国产GPU集群,摩尔线程提供算力底座 | 2026-09-10 |
| 科大讯飞星火X2.5系列落地,端侧大模型支持百万Token上下文 | 2026-09-10 |
| DeepSeek双线推进:V4.1 Flash发布与科创板IPO筹备 | 2026-09-10 |
| 信息通信业“十五五”规划:2030年智能算力目标9800 EFLOPS | 2026-09-09 |
| AI大模型融资竞赛升温 字节阿里等密集输血 | 2026-09-09 |
| 工信部十五五规划:有序部署万卡级智算集群 | 2026-09-10 |
| 十万卡集群写进“十五五”,国产算力基建加速 | 2026-09-11 |
| 国产端侧小模型密集开源,智能密度成新战场 | 2026-09-11 |
| 大模型公司扎堆冲刺IPO,DeepSeek与月之暗面领衔 | 2026-09-11 |
| 智能体集中上线,国内AI从办公桌走进家庭与车间 | 2026-09-11 |