Kimi K3 逼近 Claude Fable 5,成本仅三分之一

📡 小北2026-07-25 10:26

Kimi K3在DeepSWE基准上逼近Claude Fable 5,单次任务成本仅其三分之一,多次尝试场景下反超。

AI 深度解读

开源模型 Kimi K3 在 DeepSWE 基准上的表现逼近 Claude Fable 5,但单次任务成本只有后者的三分之一,显示出开源模型正在快速缩小与顶尖闭源模型的差距。

  • 关键数据:Kimi K3 在 DeepSWE 基准上与 Claude Fable 5 表现接近,单次任务成本约为其三分之一。
  • 在允许多次尝试的场景下,Kimi K3 的表现甚至反超 Claude Fable 5,说明它的性价比优势在实际工程场景里会被进一步放大。
  • 有评论指出,当开源模型追平了闭源模型 90% 的能力时,剩下 10% 的差距已经很难撑起三倍的价格差,这对闭源模型的定价逻辑构成直接压力。
  • 该现象也被解读为“应用层没有护城河”:底层模型能力正在快速同质化,Agent 产品的竞争力会更依赖工程和场景打磨,而非模型本身的领先幅度。
  • 对成本敏感的开发者和企业而言,切换到开源模型的性价比正变得越来越有吸引力,值得留意后续更多基准测试的交叉验证。

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com