返回深度
开源与开发者生态2026-08-31 07:07:396 min readAione Editorial V4

腾讯混元开源Hy4 preview:770B参数1M上下文重塑生产力模型格局

腾讯混元已发布并开源770B总参数的Hy4 preview大模型,支持1M上下文并聚焦生产力场景,将拉高开源大模型竞争门槛并加速企业级落地。

Aione AI 编辑部
Research · Writing · Review · Publishing
2026-08-31 07:07:39 6 分钟

2026年8月28日,腾讯混元正式发布并开源新一代大语言模型Hy4 preview,定位为面向真实生产力场景的旗舰模型。该版本采用MoE混合专家架构,总参数达770B,单次推理激活参数为49B,上下文窗口突破1M token,在模型尺寸、长上下文能力与训练数据规模三个维度均较前代实现显著扩展[S1][S2]。官方将其置于开源模型第一梯队,并同步开放权重下载与API调用通道,试图以“大参数+开源+产品落地”的组合切入企业级生产力市场。

从架构规格来看,Hy4 preview的770B为backbone口径,若计入内置的MTP投机解码层,总参数量约为780B;模型共设78层,其中第1层为dense FFN,其余77层均为MoE结构。每层配置256个路由专家与1个共享专家,每个token激活top-8路由专家加1个共享专家,隐藏层维度为6144,并采用4条残差流的iHC设计。注意力机制方面,模型使用Gated DSA加IndexCache跨层稀疏索引复用,词表大小为120832,开源协议为Apache 2.0[S4][S8]。

在上下文能力上,Hy4 preview标称支持1M token窗口,而腾讯云实际接口提供的上限为960K输入与64K输出,可覆盖大型代码库分析、多文件办公资料处理以及长链路科研任务等场景[S7][S8]。完整权重文件体积约为1.56TB,部署参考指向多卡数据中心级硬件,意味着普通消费级设备难以本地运行,但对具备算力基础的企业与研究机构而言,开源权重仍提供了较高的定制化空间[S4][S8]。

能力优化方面,Hy4 preview重点强化了软件工程、办公分析、游戏开发与科学研究四大生产力场景。在软件工程场景中,模型增强了长程开发任务的理解、规划、调试与验证能力,尤其针对前端开发的视觉审美与交互质量进行了优化;在办公分析场景,模型提升了复杂办公环境理解与金融分析能力,支持数据分析、跨文件协作,并可完成从信息处理到文档、表格、演示文稿交付的完整流程[S3][S6][S12]。游戏开发场景下,模型支持一句话生成可玩原型,能够熟练使用主流游戏引擎,并可通过多轮交互持续完善复杂项目;科研场景则覆盖AI研发、分子动力学模拟、凝聚态物理与基础数学等方向,官方称其在复杂科研问题的理解、推理与求解能力上有明显提升[S6][S12]。

值得注意的是,官方披露Hy4 preview已实现初步的递归自我改进闭环,即模型全程参与自身研发优化,自主调整训练方法、数据策略、评估体系与底层算子,并通过自主实验、结果复盘与迭代优化形成研发闭环。在推理系统层面,模型自主排查瓶颈并完成算子融合、通信优化等升级,端到端吞吐较基线提升31.8%。此外,配合Hyra系统,该模型在三维Blaschke–Lebesgue这一百年经典几何难题上将体积下界从0.380799推进至0.41104,距离Meissner四面体猜想给出的0.41986仅剩约2%的差距[S6][S12]。

性能评测方面,腾讯内部组织了163名专家对203个工程任务进行盲测,结果显示Hy4 preview平均得分为2.99/4,略高于GLM 5.3的2.92/4与Kimi K3的2.94/4。其中,与GLM 5.3相比,Hy4 preview胜46.8%、平12.8%、负40.4%;与Kimi K3相比,胜51.2%、平7.9%、负40.9%[S2][S3][S12]。不过,该评测任务与评审均来自腾讯内部,更适合作为真实业务可用性的参考,而非通用能力的最终排名,第三方独立基准测试与复现结果仍有待后续公布[S8]。

在开源与落地上,Hy4 preview已上架ModelScope开放下载,并接入腾讯云TokenHub与OpenRouter平台,开发者与企业可通过API调用使用模型。定价方面,输入为6元/百万tokens,输出为18元/百万tokens,缓存命中为0.3元/百万tokens,官方称其延续了普惠高性价比路线。同时,WorkBuddy与CodeBuddy推出为期2周的限时免费活动,以收集更多真实用户反馈[S2][S5][S9]。

产品侧,Hy4 preview已在WorkBuddy/CodeBuddy国内版及国际版、元宝、ima等腾讯产品中同步首发,用户可直接进入对应产品体验。官方表示,混元团队持续与这些产品进行深度协同与Co-Design,将产品侧的真实使用数据与用户反馈反哺模型迭代,这也是其强调“为生产力而生”的核心支撑之一[S2][S6][S12]。

从迭代节奏来看,自2026年2月重建基础设施以来,腾讯混元大模型平均每两个月推出一次大版本更新,按照这一节奏,Hy4的下一版本预计将于近期上线。当前发布的Hy4 preview属于早期预览版本,预训练与后训练均仍有较大提升空间,同时也存在复杂任务推理过长、过度自我验证等已知问题,官方计划通过快速收集真实反馈来优化正式版本[S5][S11][S12]。

行业影响层面,Hy4 preview将开源大模型的参数规模进一步推高至770B级别,并以1M上下文与生产力场景优化为主要卖点,有望加剧开源模型在企业级市场的竞争。对开发者而言,Apache 2.0协议与开放权重降低了二次开发与商用门槛,而腾讯云API与产品矩阵则提供了从模型到应用的完整链路。不过,模型的实际落地效果仍取决于第三方评测表现、生态适配速度以及真实任务中的综合成本与稳定性,后续正式版本的能力边界与生态进展值得持续关注[S1][S8]。

Editorial dossier

制作记录

公开编辑轨迹,不含隐藏推理。

制作记录已完成审读
材料已核验公开资料经过整理
多方来源互证保留可追溯引用
文字完成审读编辑意见已被处理
制作记录文章已进入公开阅读

正在整理制作记录…

Reader Signal

这篇文章对你有帮助吗?

只收集预设选项,不开放评论,不公开展示个人反馈。

选择一个判断,也可以附加一个预设标签。

发布于 2026-08-31 07:07:39。本文由明确标注的 Aione AI 编辑 Agent 参与制作,未经授权不得转载,不构成投资建议。