770B巨兽出笼!腾讯混元Hy4 preview开源,百万上下文登顶盲测榜首
大模型开源战场再迎重磅炸弹!今日,腾讯正式推出了混元 Hy4 preview 模型。这款拥有 770B 总参数、49B 激活参数的“巨无霸”,不仅将上下文窗口拉长至惊人的 1M(百万级),更在尺寸、数据规模及智能水平上实现了全面跨越,稳稳站上了全球开源模型的第一梯队。
百万上下文加持,全面拥抱开源生态
Hy4 preview 的核心亮点在于其庞大的参数规模与超长的上下文处理能力。依托预训练与后训练的双重技术突破,该模型在理解深度与生成质量上迎来了显著跃升。
为了方便开发者与研究者使用,腾讯已将该模型全面开源。目前,用户可以在 HuggingFace、GitHub、ModelScope 以及 Gitcode 等主流平台上获取模型权重。同时,该模型也已无缝接入腾讯云 TokenHub 与 OpenRouter,大幅降低了开发者的调用门槛。
盲测力压群雄,四大生产力场景全面开花
在真实业务场景中,Hy4 preview 展现出了极强的实战能力。这得益于腾讯内部软件工程、游戏、金融及安全等领域专家提供的高质量数据共建。
在近期的内部盲测中,腾讯组织了 163 名内部专家,针对 203 个实际工程任务进行了严格评估。结果显示,Hy4 preview 以 2.99 的均分(满分 4.00)拔得头筹,微弱但稳定地超越了 GLM-5.3(2.92 分)与 Kimi K3(2.94 分)。
具体到生产力场景,其进阶表现尤为亮眼:
– 软件工程:大幅强化了对长程代码开发的理解、规划与验证能力。
– 办公分析:能够一站式完成从底层数据处理到最终文档、表格及演示文稿的完整交付。
– 游戏开发:仅需一句自然语言需求,即可直接生成可运行的游戏原型。
– 科学研究:在分子动力学、凝聚态物理等前沿方向取得了实质性进展。
攻克百年几何难题,科研能力惊艳
除了常规的工程任务,Hy4 preview 在基础科学领域的表现同样令人瞩目。配合 Hyra 系统,该模型在百年几何难题——三维 Blaschke–Lebesgue 问题上取得了关键性突破。
它将体积下界从原先的 0.380799 成功推进至 0.41104。这一数据距离 Meissner 四面体猜想所给出的理论值 0.41986 仅剩约 2% 的微小差距,充分彰显了其强大的逻辑推理与科学计算潜能。
坦诚已知问题,深度融入腾讯生态
尽管成绩斐然,腾讯官方也坦诚表示,Hy4 preview 目前仍处于 Hy4 系列的早期迭代阶段。模型在预训练与后训练方面仍有优化空间,且在处理复杂任务时存在长思考耗时、过度自我验证等已知缺陷。未来,团队将通过敏捷迭代持续解决这些问题。
在落地应用方面,Hy4 preview 已与腾讯旗下的 CodeBuddy 和 WorkBuddy 实现深度协同。普通用户也可以直接通过腾讯元宝、ima 等成熟产品, firsthand 体验这款顶级开源模型带来的效率革新。