8月28日,腾讯混元正式发布并开源新一代大语言模型Hy4 preview。该模型拥有770B总参数及49B激活参数,上下文长度突破100万,在代码编写、办公处理及科学研究等真实生产力任务中表现卓越。
Hy4 preview在模型规模、上下文长度及数据规模上均有显著扩展,通过预训练与后训练的双重提升,其智能水平再上新台阶,稳居开源模型第一梯队。混元持续深化与CodeBuddy、WorkBuddy等产品的协同,以优化真实生产力场景的用户体验。在腾讯内部163名专家参与的203项工程任务盲测中,Hy4 preview以2.99分的均分略胜一筹,高于GLM 5.3(2.92分)和Kimi K3(2.94分)。
作为“为生产力而生”的模型,Hy4 preview通过与软件工程、游戏、金融、安全等领域的腾讯专家共建高质量数据,并借助WorkBuddy等产品的深度协同,在各类生产力任务上取得了显著进步。具体应用方面,该模型在软件工程场景下强化了长程开发任务的规划、调试与验证能力,同时提升了前端开发的视觉审美与交互质量;在办公分析场景下,显著增强了对复杂办公环境和金融分析的理解,优化了跨文件协作与数据分析流程,实现了从信息处理到文档、表格及演示文稿交付的全链路覆盖;在游戏开发场景中,实现了从需求到可玩原型的快速生成,熟练运用游戏引擎,支持开发者通过多轮交互完善复杂项目;在科学研究场景下,大幅提升了对复杂科研问题的理解、推理与求解能力,在AI研发、分子动力学模拟、凝聚态物理及基础数学等领域均取得长足进展。
值得一提的是,Hy4 preview在研发全链路中展现了自我优化能力。它首次参与训练方法、数据策略、评估体系及底层算子的自动优化。通过“提出方案-运行实验-根据反馈迭代”的闭环,模型能持续利用实验代码、日志等数据探索新方向,初步实现了递归自我改进。此外,Hy4 preview具备自主分析推理系统瓶颈的能力。通过在算子融合、通信优化等方面的多轮迭代,其端到端吞吐量较基线提升了31.8%,并在不同上下文长度和并发度下保持稳定收益,展现了自主优化推理基础设施的潜力。
Hy4 preview现已开源,并在WorkBuddy/CodeBuddy(国内版及国际版)、元宝、ima等腾讯产品同步首发。用户可直接通过产品体验,也可通过腾讯云Tokenhub和OpenRouter接入API使用。在定价上,Hy4 preview延续高性价比路线:输入价格为6元/百万tokens,输出为18元/百万tokens,缓存命中价格为0.3元/百万tokens。为收集用户反馈以持续提升性能,WorkBuddy/CodeBuddy将于近期开启为期2周的限时免费活动。
自今年2月重建基础设施以来,混元大模型平均每两个月迭代一次大版本。通过“Preview先行、正式版跟进”的节奏,混元将真实世界的反馈持续引入研发过程,使模型在实践中不断进化。按照这一规划,Hy4的下一版模型也将在近期陆续上线。
