B站上线「AI无限竞技场」大模型测评榜单,GPT-6位列榜首
哔哩哔哩正式上线大模型测评榜单“AI无限竞技场”,首期结果显示GPT-6位居综合排名第一。
AI 深度解读
哔哩哔哩(B站)于 2026 年 9 月 16 日正式上线「AI无限竞技场」大模型评测平台并公布首期榜单,尝试以社区创作者真实工作流场景构建新型模型实测体系。
- 首期榜单中 GPT-6 获得榜首次数最多,国产大模型亦在前五名中占据三席,展现了在不同应用场景下的竞争表现。
- 评测机制依托 UP 主自主命题与实际工作流检验(如复杂代码调试、游戏开发及创意生成等),不设固定标准化题库,榜单数据随创作者投稿动态更新。
- 相比侧重学术基准或盲测对话排名的测评平台,该模式更侧重检验大模型在具体垂直业务场景中的实用落地能力。
- 影响/看点:该竞技场可能为大众用户与开发者提供更具实践参考价值的选型依据,但其长远公信力取决于社区测评样本的客观性、防刷榜机制以及命题标准的系统化管理。
- 资料依据:
- 量子位(2026-09-16):https://www.qbitai.com/2026/09/490396.html
- 哔哩哔哩(2026-09-16):https://www.bilibili.com/blackboard/era/aiarena.html
本内容由 AI 生成,仅供参考,请注意甄别