腾讯混元 Hy4 preview发布,稳居开源模型第一梯队
腾讯混元 Hy4 preview 发布并开源,腾讯梯队在真实生产力任务上展现卓越能力
8 月 28 日,混元腾讯混元发布并开源新一代大语言模型 Hy4 preview ,布稳总参数 770B、居开激活参数 49B,源模上下文长度突破 1M,型第在代码、腾讯梯队办公、混元科学等真实生产力任务上展现出卓越能力。布稳
Hy4 preview 在模型尺寸、居开上下文长度、源模数据规模上都进行了显著的型第扩展,预训练和后训练的腾讯梯队共同进步带来了智能水平的又一次巨大提升,稳居开源模型第一梯队。混元

混元持续与 CodeBuddy / WorkBuddy 等产品深度协同,优化生产力场景的真实用户体验。在腾讯内部组织的 163 名内部专家、203 个工程任务的盲测中, Hy4 preview(均分2.99/4)略优于 GLM 5.3(均分2.92/4.00) 和 Kimi K3(均分2.94/4.00)。
Hy4 preview 定位“为生产力而生”的模型,通过与软件工程、游戏、金融、安全等顶尖腾讯专家的高质量数据共建,以及与 WorkBuddy 等产品的深度协同(Co-Design),模型在各类真实生产力任务上取得显著进步。
具体来看,在软件工程场景下,模型增强了长程开发任务的理解、规划、调试与验证能力,进一步提升前端开发的视觉审美和交互质量。
在办公分析场景下,显著提升了复杂办公环境理解和金融分析能力,着重优化数据分析、跨文件协作,完成从信息处理到文档、表格与演示文稿交付的完整流程。
在游戏开发场景中,增强了一句需求直接生成可玩原型能力,并能熟练使用游戏引擎,开发者可以通过多轮交互持续完善复杂游戏项目。
在科学研究场景下,显著提升复杂科研问题的理解、推理与求解能力,模型在 AI 研发、分子动力学模拟、凝聚态物理、基础数学等各类场景中均有长足进步。
值得一提的是,Hy4 preview 在自身研发的全链路过程中发挥了积极价值,首次参与训练方法、数据策略、评估体系和底层算子的自动优化。模型提出方案、运行实验并根据结果继续迭代,实验产生的代码、日志和反馈进入下一轮探索,形成初步的递归自我改进闭环。
Hy4 preview 还通过自主分析推理系统瓶颈,并围绕算子融合、通信优化等方向开展多轮优化,端到端吞吐相较基线提升 31.8%,在不同上下文长度和并发度下均取得稳定收益,初步展现了自主开展推理基础设施优化的能力。
Hy4 preview 已经开源,并在 WorkBuddy/CodeBuddy 国内版及国际版、元宝、ima 等腾讯产品同步首发,用户可直接通过产品体验,还可以通过腾讯云 Tokenhub 和 OpenRouter 接入 API 使用。定价方面,Hy4 preview 继续走普惠的高性价比路线,输入 6元/百万 tokens,输出 18 元/百万 tokens,缓存命中 0.3 元 / 百万 tokens。
为进一步收集用户对模型的反馈以进一步提升模型性能,WorkBuddy/CodeBuddy 将面向用户开展为期2周的限时免费活动。
自 2 月重建基础设施以来,混元大模型平均每两个月迭代一次大版本。通过 preview 先行、正式版跟进的方式,混元把真实世界的反馈持续引入研发过程,让模型在解决实际问题中进步。按照这一节奏,Hy4 的下一版模型也将在近期陆续上线。雷峰网(公众号:雷峰网) 雷峰网
相关文章
召集所有勇敢的冒险者,踏上惊险旅程——《终极幸运之塔》正式结束抢先体验,准备逃离伊维利乌斯之塔!由 Studio Seufz 开发、AMC Games 发行的《终极幸运之塔》(Lucky Tower2026-09-23
为深入贯彻落实《关于推进重点网站平台定期通报网络侵权举报受理处置情况工作的通知》,充分发挥网络举报工作在维护保障网民网络合法权益中的重要作用,根据中央网信办要求,3DMGAME定期公布网络侵权举报受理2026-09-23
保险平台的理赔服务差距在哪?专业经纪、流量、保司自营横向对比
导读: 刚接触保险的新手,常会搜索这几个问题:哪个保险平台理赔最好?保险理赔和购买2026-09-23
12月份以来部分玻璃产能集中冷修,在未来竣工面积增速回升预期下,价格有所企稳;而四季度货品价格下降也为相关产业带来利润空间短期改善的机会。水泥行业高盈利靠错峰、限产、自律完成;未来错峰放松,限产差异化2026-09-23
导读: 30万重疾险性价比高,重疾险保30万好还是50万好?相信这个问题并不难,当然是根据实力出发,肯定保额越高越好,所以小编想给大家推荐2026-09-23
孩子就医报销怎么选保险?微医保·少儿百万医疗险打造“基础”/“全面”双方案
导读: 当家长的都有体会:孩子一生病,跑门诊、挂急诊、排长队……钱花了人也累。少儿2026-09-23

最新评论