菜单
小墨

小墨

腾讯混元 Hy4 Preview 发布:770B 参数、1M 上下文,开源模型第一梯队实力几何?

开源大模型赛道再添重磅选手。8 月 28 日,腾讯混元正式发布并开源新一代大语言模型 Hy4 Preview,该模型以 770B 总参数、49B 激活参数的规模亮相,上下文长度突破 100 万 tokens 大关。这一参数的跃升意味着什么?意味着模型能够一次性处理更长的代码库、更复杂的文档分析任务,以及更深入的多轮对话场景。在当前开源大模型竞争日趋激烈的背景下,Hy4 Preview 的问世无疑为行业注入了新的活力。

四大核心场景深度解析

从核心架构来看,Hy4 Preview 在模型尺寸、上下文长度、数据规模三个维度均进行了显著扩展。预训练与后训练阶段的协同优化,推动了模型智能水平的又一次跃升。在腾讯内部组织的盲测评估中,163 名工程专家对 203 个真实工程任务进行评测,Hy4 Preview 最终取得 2.99/4.00 的平均分,略优于 GLM 5.3(2.92 分)和 Kimi K3(2.94 分)。这一结果表明,Hy4 Preview 已经稳稳站在开源模型的第一梯队,具备与头部闭源模型同台竞技的实力。

软件工程场景

Hy4 Preview 的定位清晰明确——「为生产力而生」。围绕这一理念,腾讯通过与软件工程、游戏、金融、安全等领域顶尖专家的高质量数据共建,以及与 WorkBuddy 等产品的深度协同(Co-Design),让模型在各类真实生产力任务上取得了显著进步。

Hy4 Preview 的开源发布,不仅是参数规模的简单堆叠,更代表了国产大模型在真实生产力场景应用上的深度探索与突破。

“行业观察”
积墨 AI 核心产品

积墨 AI 智能体开发平台

快速搭建具备商业价值的 AI 智能体,支持复杂工作流编排、50+ 主流模型接入与私有化部署。

游戏开发场景

在软件工程领域,Hy4 Preview 显著增强了长程开发任务的理解、规划、调试与验证能力,尤其在前端开发场景中,模型的视觉审美和交互质量有了明显提升。对于需要处理复杂代码库、进行跨模块分析的开发者而言,这无疑是一大福音。而在办公分析场景中,模型对复杂办公环境和金融分析能力的理解更加深入,数据分析、跨文件协作等任务的处理效率大幅提升,能够完成从信息处理到文档、表格、演示文稿交付的完整流程。

科学研究场景

游戏开发方面,Hy4 Preview 支持一句话需求直接生成可玩原型的能力,并能够熟练使用主流游戏引擎。开发者可以通过多轮交互持续完善复杂游戏项目,大大降低了游戏原型开发的时间成本。在科学研究领域,模型在复杂科研问题的理解、推理与求解方面表现突出,涵盖 AI 研发、分子动力学模拟、凝聚态物理、基础数学等多个场景,展现出强大的通用推理能力。

如有侵权,请联系删除。

#开源大模型#腾讯混元#大模型#AI技术
分享文章

相关文章推荐

试用咨询
企业微信二维码

扫码添加企业微信