Bending Spoons 透露 99% AI 请求均由自托管开源模型承载

📡 Rohan Paul2026-09-20 09:08

Bending Spoons 透露其 99% 的 AI 请求由自托管开源模型处理,闭源前沿模型仅用于极少数复杂任务和质检验收。

AI 深度解读

软件公司 Bending Spoons 首席执行官 Luca Ferrari 透露其业务中约 99% 的 AI 请求由自托管开源权重模型处理,展示了成熟软件企业在 AI 规模化落地中的成本优化路径。

  • 架构分工上,该公司将约 99% 的常规 AI 请求和 Token 消耗交由自托管开源模型承担,日常推理成本主要体现为云基础设施开销。
  • 闭源前沿模型仅承担约 1% 的调用量,专门用于复杂高难度任务,或作为自动化复核机制评估开源模型的推理输出。
  • 这种混合架构兼顾了高并发场景的吞吐经济性与关键场景的准确率,避免了全量调用商业 API 带来的高昂账单。
  • 影响/看点:该实践意味着应用层企业在流量扩大后转向自托管开源模型具备显著的成本优势,其成立条件是企业需具备模型微调、自动化评测与云基础设施运维能力。
  • 资料依据:
  • X:Rohan Paul(2026-09-20):https://x.com/rohanpaul_ai/status/2101478518882550031
  • Bending Spoons(2026-09-19):https://bendingspoons.com/newsroom

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手