Kimi K3上线2天成OpenRouter第10大模型,基础设施已不堪重负
Kimi K3上线2天成OpenRouter第10大模型,但吞吐量下降,基础设施不堪重负。
AI 深度解读
Kimi K3上线2天成OpenRouter第10大模型,基础设施不堪重负,算力价值凸显。
- Kimi K3日处理约140B token,但吞吐量从30tok/s降至13tok/s,端到端延迟达72秒,性能严重下降。
- 服务量化版K3需至少8块B300($50万),推荐GB300 NVL72机架则需约$400万,算力成本高昂。
- 前沿模型价格3年仅降4-5倍,而需求增长超3个数量级,算力锁定者将获得巨大价值。
- 这一现象预示未来几年AI竞争的核心将是算力,而非模型架构创新。
- 影响/看点:Kimi K3的算力困境揭示了AI规模化部署的经济学挑战,算力投资将成为决定模型公司成败的关键因素,算力资源可能成为新的战略资产。
本内容由 AI 生成,仅供参考,请注意甄别