蚂蚁百灵发布 Ling-3.0-flash-fin 模型:总参数 124B 激活 5.1B,开放免费 API

📡 蚂蚁百灵2026-09-23 09:12

蚂蚁百灵发布 Ling-3.0-flash-fin 模型(总参数124B/激活5.1B),并开放免费 API。

AI 深度解读

2026 年 9 月 23 日,蚂蚁百灵通过官方社交账号宣布推出 Ling-3.0-flash-fin 稀疏激活模型并开放免费 API,因其在较大总参数规模下维持较低激活开销而受到关注。

  • 模型架构参数:该模型总参数量为 124B,实际单次推理激活参数为 5.1B,采用混合专家(MoE)结构以控制计算开销。
  • 部署与量化支持:官方同步提供了 fp4 量化版本,便于端侧与本地离线环境部署运行。
  • 评测与服务接入:第三方评测机构 Vals AI 对该模型完成了基准评测,目前官方已面向开发者开放免费 API 接口试用。
  • 影响/看点:该模型若能在量化和低激活参数下保持稳定的特定领域逻辑能力,可能进一步降低中小开发者的本地推理部署门槛,其实际效果取决于业务场景中的推理精度与吞吐表现。
  • 资料依据:
  • X:蚂蚁百灵官方账号(2026-09-23):https://x.com/AntLingAGI/status/2102566821669011798
  • Vals AI 评测基准报告(2026-09-23):https://vals.ai/evals/ling-3.0-flash-fin

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手