bml.asia · 纯文字 · 写写停停

腾讯混元 Hy4 preview 开源了

  腾讯混元今天放出了 Hy4 preview,参数配置一看就是冲着开源第一梯队去的:总参数 770B,激活参数却只有 49B,稀疏度压到约百分之六点四——这意味着它用接近 49B 稠密模型的推理成本,撑起了 770B 的知识容量,是典型的激进 MoE 设计。上下文长度直接拉到 1M,一次性装下整个代码仓库或几百页长文档不成问题,这对代码理解、长文分析这类真实工作负载来说,比单纯堆参数更有实际意义。目前模型已开源,并在腾讯云 TokenHub、OpenRouter 上线,WorkBuddy、CodeBuddy、元宝、ima 等腾讯产品也同步首发,等于把模型能力和自家工具链绑在了一起。

  性能方面,最能说明问题的是腾讯内部的盲测数据:163 名专家、203 个工程任务,Hy4 preview 拿到均分 2.99 分(满分 4 分),略高于 GLM 5.3 的 2.92 和 Kimi K3 的 2.94。这个分数差距看着不大,但用的是自家软工、游戏、金融、安全领域的真实任务,比跑标准榜单更能反映生产力场景下的真实水平。官方称其在代码、办公、科学任务上有显著进步,结合它和 CodeBuddy、WorkBuddy 的深度协同,这些能力不是停留在评测里,而是直接落到了实际工具上。对国内开源生态来说,Hy4 preview 这次的意义不只是多了一个大模型,而是用"低激活比例 + 超长上下文 + 真实场景验证"这套组合,把开源模型的实用门槛又往上抬了一截。