腾讯发布混元 Hy4 预览版:770B 开源大模型与 1M 上下文
腾讯发布开源大模型混元 Hy4 预览版,拥有 770B 总参数及 100 万 token 上下文窗口。
AI 深度解读
腾讯混元团队于 2026 年 8 月 28 日正式开源混合专家架构模型 Hy4 预览版,以 770B 总参数量和超过 100 万 token 的上下文窗口,为长文本与复杂任务处理提供了新的开源选项。
- Hy4 Preview 采用 MoE(混合专家)架构,总参数量达 770B,每个 token 激活参数为 49B,模型权重在 Hugging Face 上占用约 1.56TB,较上一代 295B 总参数的 Hy3 规模有明显增加。
- 模型开源协议为 Apache 2.0,支持超过 1M token 的超长上下文,并内嵌 MTP(模型目标预测)层以支持推测解码加速。
- 官方对话模板明确设置了两种推理模式,包括默认的高强度深度推理模式(high)与直接输出模式(no_think),支持针对不同场景调节思考消耗。
- 腾讯同步在 WorkBuddy、CodeBuddy、元宝和 ima 等应用端接入该模型,并在 Hugging Face、ModelScope、TokenHub 和 OpenRouter 开放权重与 API。
- 影响/看点:770B 级别超长上下文开源模型的推出可能降低企业部署长流程智能体与复杂代码分析的门槛,但其大规模落地仍受制于 1.5TB 权重对本地硬件显存与多卡集群配置的高要求。
- 资料依据:
- Simon Willison 博客:https://simonwillison.net/2026/Aug/29/hy4/
- 腾讯混元官方发布:https://hy.tencent.ai/research/hy4-preview
- Hugging Face 模型库:https://huggingface.co/tencent/Hy4-preview
本内容由 AI 生成,仅供参考,请注意甄别