Artificial Analysis 评测 Step 5 Preview:得 44 分且单任务成本仅 0.72 美元
Artificial Analysis评测显示Step 5 Preview得分44,成本仅为同级模型约三分之一。
AI 深度解读
评测机构 Artificial Analysis 公布了对阶跃星辰(StepFun)新旗舰模型 Step 5 Preview 的综合评测,展现出高性价比的推理能力及特定短板。
- 架构与体量上,Step 5 Preview 为 600B 总参数、27B 激活参数的 MoE 架构,支持 1M 上下文窗口与多模态输入。
- 综合得分上,其在 Artificial Analysis Intelligence Index 获得 44 分,与 Kimi K3(max)持平,单任务成本约为 0.72 美元(同分模型均值约 2.00 美元),API 输入/输出定价为每百万 Token 1 美元/2.70 美元。
- 性能表现上,该模型在前沿推理测试 HLE 取得 46%,但在 Agent 专项评测(如 GDPval-AA 取得 1566 Elo、Terminal-Bench 4.0 取得 33%)上落后于同梯队竞品。
- 影响/看点:这一评测结果表明 MoE 架构优化有效压缩了高阶推理任务的调用成本,若阶跃星辰按计划于 10 月 15 日开源模型权重,可能为开发者社区提供具备成本优势的大参数基座选项。
- 资料依据:
- Artificial Analysis 官方发布(2026-09-22):https://x.com/ArtificialAnlys/status/2102213621963243704
- Artificial Analysis 评测方法说明(2026-09-22):https://artificialanalysis.ai/methodology
本内容由 AI 生成,仅供参考,请注意甄别