腾讯混元发布 Hy4 Preview:770B 参数与 1M 上下文,端到端吞吐提升 31.8%
腾讯混元开源具备 1M 上下文与 770B 参数的 Hy4 Preview 模型,可自主优化推理瓶颈并提升 31.8% 吞吐。
AI 深度解读
腾讯混元推出 770B 总参数、49B 激活的开源大模型 Hy4 preview 并支持 1M 上下文,展示了大规模 MoE 架构在长文本与推理效率上的工程实践。
- 模型总参数规模达 770B,单次推理激活参数为 49B,兼顾模型表征容量与运行计算开销。
- 具备 1M token 的长上下文处理能力,定位于生产力场景并保持开源分发。
- 官方披露该模型在研究中自主定位了推理瓶颈,结合算子融合与通信优化使端到端吞吐提升 31.8%,并在多并发和长序列下维持稳定性。
- 影响/看点:高参数与稀疏激活结合工程优化有助于降低长文本推理成本,但其实际吞吐收益仍取决于部署硬件配置与具体工作负载的契合度。
- 资料依据:
- 腾讯混元官方发布(2026-09-01):https://x.com/TencentHunyuan/status/2094730117541155001
本内容由 AI 生成,仅供参考,请注意甄别