蚂蚁百灵发布 Ling-3.0-flash-fin 模型:总参数 124B 激活 5.1B,开放免费 API
蚂蚁百灵发布 Ling-3.0-flash-fin 模型(总参数124B/激活5.1B),并开放免费 API。
AI 深度解读
2026 年 9 月 23 日,蚂蚁百灵通过官方社交账号宣布推出 Ling-3.0-flash-fin 稀疏激活模型并开放免费 API,因其在较大总参数规模下维持较低激活开销而受到关注。
- 模型架构参数:该模型总参数量为 124B,实际单次推理激活参数为 5.1B,采用混合专家(MoE)结构以控制计算开销。
- 部署与量化支持:官方同步提供了 fp4 量化版本,便于端侧与本地离线环境部署运行。
- 评测与服务接入:第三方评测机构 Vals AI 对该模型完成了基准评测,目前官方已面向开发者开放免费 API 接口试用。
- 影响/看点:该模型若能在量化和低激活参数下保持稳定的特定领域逻辑能力,可能进一步降低中小开发者的本地推理部署门槛,其实际效果取决于业务场景中的推理精度与吞吐表现。
- 资料依据:
- X:蚂蚁百灵官方账号(2026-09-23):https://x.com/AntLingAGI/status/2102566821669011798
- Vals AI 评测基准报告(2026-09-23):https://vals.ai/evals/ling-3.0-flash-fin
本内容由 AI 生成,仅供参考,请注意甄别