[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"aihot-art-93898":3},{"itemId":4,"vertical":5,"category":6,"source":7,"score":8,"title":9,"summary":10,"analysis":11,"url":12,"coverUrl":13,"direction":13,"marketSignal":13,"publishedAt":14},"93898","ai","行业动态","Deedy Das",60,"Kimi K3上线2天成OpenRouter第10大模型，基础设施已不堪重负","Kimi K3上线2天成OpenRouter第10大模型，但吞吐量下降，基础设施不堪重负。","Kimi K3上线2天成OpenRouter第10大模型，基础设施不堪重负，算力价值凸显。\n· Kimi K3日处理约140B token，但吞吐量从30tok\u002Fs降至13tok\u002Fs，端到端延迟达72秒，性能严重下降。\n· 服务量化版K3需至少8块B300（$50万），推荐GB300 NVL72机架则需约$400万，算力成本高昂。\n· 前沿模型价格3年仅降4-5倍，而需求增长超3个数量级，算力锁定者将获得巨大价值。\n· 这一现象预示未来几年AI竞争的核心将是算力，而非模型架构创新。\n影响\u002F看点：Kimi K3的算力困境揭示了AI规模化部署的经济学挑战，算力投资将成为决定模型公司成败的关键因素，算力资源可能成为新的战略资产。","https:\u002F\u002Fx.com\u002Fdeedydas\u002Fstatus\u002F2078874115910615544",null,"2026-07-20 00:06:27"]