⚡ 猫叔的AI资讯雷达
模型开源Agent

腾讯开源混元 Hy4 Preview,上下文扩至百万 Token

腾讯发布混元 Hy4 Preview 开放权重,以 7700 亿总参数、490 亿激活参数和百万 Token 上下文主攻生产力智能体。

权重已开放,架构进一步扩容

腾讯正式发布混元 Hy4 Preview,并通过 Hugging Face、ModelScope、GitCode 和 CNB 提供完整精度及 FP8 版本权重。该模型采用混合专家架构,总参数量为 7700 亿,每个 Token 激活 490 亿参数,支持最长 100 万 Token 上下文。

Hy4 的每个混合专家层设有 256 个路由专家,每次激活其中八个及一个共享专家。注意力模块结合门控稀疏注意力与跨层索引复用,另有原生多 Token 预测层用于推测解码。腾讯同时给出了 vLLM 和 SGLang 部署方案,但如此规模的模型仍远超普通工作站的承载能力。

面向生产力智能体优化

腾讯将 Hy4 的重点场景放在编程、办公、游戏开发和科学研究。公司组织 163 名内部专家,对 203 项工程任务进行盲测;Hy4 平均得分为 2.99 分,略高于 GLM-5.3 的 2.92 分和 Kimi K3 的 2.94 分。不过,这组结果来自厂商内部测试,仍需独立评测验证。

腾讯还称,Hy4 参与了自身训练方法、数据策略、评估体系和底层算子的优化,并通过算子融合与通信优化,将端到端推理吞吐量较内部基线提高 31.8%。模型卡也明确列出当前缺陷,包括复杂任务中思考时间偏长,以及反复验证自身结论。

Hy4 已接入腾讯旗下产品、腾讯云 TokenHub 和 OpenRouter。官方 API 定价为每百万输入 Token 0.834 美元、输出 2.501 美元,缓存 Token 为 0.042 美元。

为什么重要

Hy4 为快速扩大的中国开放权重模型阵营增加了一个真正的大体量选手。百万上下文、面向智能体的训练和可下载权重,让研究机构与基础设施厂商能够实际检查和部署它。悬念在于运行效率:每次只激活 490 亿参数固然降低了计算量,但托管一个 7700 亿参数检查点依然需要昂贵的硬件资源。

信源