2026年8月28日,腾讯混元正式推出Hy4 preview——新一代旗舰大语言模型预览版。总参数770B,每token仅激活49B,采用稀疏化MoE架构,原生支持100万token上下文,端到端推理吞吐较上一代提升31.8%。模型已开源,权重在HuggingFace、Github、Modelscope、Gitcode同步开放,并接入WorkBuddy、CodeBuddy、元宝、ima等腾讯系产品,以及aistudio.tencent.com在线试玩、OpenRouter与TokenHub API调用入口。
一、稀疏化MoE架构:770B容量,49B激活
Hy4 preview的核心技术路线是稀疏化MoE。770B总参数通过路由机制每次仅激活49B(约6.4%),在旗舰级知识容量与可控推理成本之间取得平衡。原生100万token上下文可一次性载入整本技术文档或大型代码仓库,减少分块摘要带来的信息损失,这对代码库级分析和长文档推理尤为重要。
官方实测数据显示,端到端推理吞吐较上一代提升31.8%,相同硬件下可支撑更高并发与更低单次延迟。在AI工具导航的框架下,Hy4 preview的路线选择清晰:用稀疏化架构保持旗舰能力的同时控制推理成本,为长上下文、高吞吐的企业级场景提供一个可规模化的开源选项。相比完全闭源的旗舰模型,开源权重意味着企业可以在自有环境中进行私有化部署和二次调优;相比轻量模型,49B激活参数保证了复杂任务的处理深度。
二、科研突破与生产力任务
Hy4 preview的亮点不止于常规的语言任务。官方公布的科研侧进展显示,模型将分子动力学模拟效率提升至2倍,与Hyra协同将三维Blaschke-Lebesgue体积下界推进到0.41104——这一成绩被部分数学社区视为值得关注的进展。在真实生产力任务中,代码编写、办公文档处理、游戏开发等高强度场景均有明显增益。
三、与主流旗舰模型的对比
| 对比维度 | Hy4 preview | DeepSeek-V4-Flash | Claude Opus 4.6 |
|---|---|---|---|
| 参数规模 | 770B / 49B | 284B / 13B | 未公开 |
| 上下文 | 100万token | 100万token | 100万token |
| 开源情况 | 已开源(权重开放) | 已开源(MIT) | 闭源商业 |
| 输入价格 | ¥6/百万tokens | $0.14(≈¥1.0) | $5.00(≈¥35.5) |
| 输出价格 | ¥18/百万tokens | $0.28(≈¥2.0) | $25.00(≈¥177.5) |
三款百万上下文模型走出了三条路线:Hy4 preview以770B/49B稀疏架构覆盖旗舰通用与科研场景;DeepSeek-V4-Flash用轻量配置压低单价,主打性价比与高并发Agent;Claude Opus 4.6维持旗舰溢价,在专业任务深度上仍有优势。在AI办公软件推荐的逻辑中,Hy4 preview的定位更接近“企业级生产力底座”——它既可以被业务系统直接调用,处理长文档和代码库分析;也可以作为科研团队的基础推演工具,参与数学和物理建模;同时开源权重为有私有化需求的机构提供了自部署选项。
四、应用场景与适用人群
长文档与代码库分析:一次性载入整本技术手册或大型仓库,做跨文件依赖梳理与重构建议
科研计算与推演:分子动力学、几何与物理建模等需要长程推理的任务
高并发Agent:多轮工具调用与长链路推理,依赖低延迟与稳定上下文
适用人群:需要百万级上下文的企业研发团队、关注数学与物理推演潜力的科研机构、在旗舰质量与可控成本之间寻求平衡的技术选型者。
五、如何使用Hy4 preview
在线体验:通过WorkBuddy/CodeBuddy/元宝/ima切换模型,或访问aistudio.tencent.com直接试玩
API调用:OpenRouter或腾讯云TokenHub获取API Key,使用OpenAI兼容格式,model设为tencent/hy4-preview
自部署:从HuggingFace/Github/Modelscope/Gitcode拉取开源权重,需自备GPU环境
定价方面,官方走人民币计价路线:输入6元/输出18元每百万token、缓存命中0.3元;OpenRouter等渠道约$0.83/$2.5每百万token(汇率折算)。WorkBuddy/CodeBuddy当前2周限时免费。作为preview版本,能力持续迭代,生产环境建议先小流量验证。
