[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"aihot-art-100711":3},{"itemId":4,"vertical":5,"category":6,"source":7,"score":8,"title":9,"summary":10,"analysis":11,"url":12,"coverUrl":13,"direction":13,"marketSignal":13,"publishedAt":14},"100711","ai","行业动态","IT之家",63,"英伟达 Blackwell GB300 刷新 MoE 预训练纪录：每 GPU 算力 1648 TFLOPs","英伟达 Blackwell GB300 在 DeepSeek-v3 671B 模型预训练中创下每 GPU 1648 TFLOPs 的世界纪录。","英伟达 Blackwell GB300 刷新 MoE 预训练世界纪录，每 GPU 算力达 1648 TFLOPs，较上一代提升约 3 倍。\n· 使用 256 块 GPU 预训练 DeepSeek-v3 671B 模型，实现每 GPU 1648 TFLOPs 吞吐量。\n· 通过模拟 25 万种配置，发现 38 项优化，累计 140 万小时 GPU 测试。\n· 相比 2025 年 11 月的 1088 TFLOPs 提升 50%，较 GB200 的 606 TFLOPs 提升约 3 倍。\n· 用更少 GPU 达到相同性能，展示了硬件与软件协同优化的巨大潜力。\n影响\u002F看点：GB300 的纪录证明英伟达在 AI 训练效率上的持续领先，为大规模 MoE 模型训练树立新标杆。","https:\u002F\u002Fwww.ithome.com\u002F0\u002F980\u002F018.htm",null,"2026-07-22 14:20:55"]