面向长周期任务的推理模型 Apodex 1.1 正式发布

📡 Testing Catalog2026-09-16 17:42

Apodex发布1.1系列长周期推理模型,支持文件处理与代码环境,可生成来源可溯的分析结果。

AI 深度解读

Apodex AI 发布面向长周期复杂任务的推理模型 Apodex 1.1 及其配套开源框架 FrontierAgent,旨在提升跨环境长时间任务执行的可靠性与论断可追溯性。

  • 多智能体协作机制:支持单智能体 ReAct 与多智能体 Agent Team 协作模式,由协调智能体拆解长周期目标并分发给子智能体并行执行与相互核验。
  • 环境交互与论据溯源:具备文件解析、网页搜索与代码执行环境交互能力,生成的分析报告要求每一处核心论断均可追溯至原始证据来源。
  • 专业基准测试表现:在 APEX-Agents 智能体基准测试中获得 38.5 分,并在 BioMysteryBench 等科研评估中相较 1.0 版本取得明显提升。
  • 开源生态与轻量部署:配套的 FrontierAgent 运行套件已在 GitHub 开源,并提供 35B 参数规模的 Mini 版本以便本地化私有部署。
  • 影响/看点:多智能体任务拆解与独立核验流程可能降低长流程任务的累计错误与幻觉率,其在科研与金融等专业领域的实际价值取决于对非标准化工作流的异常恢复能力。
  • 资料依据:
  • X:Testing Catalog (@testingcatalog)(2026-09-16):https://x.com/testingcatalog/status/2100158494531838100
  • GitHub 开源仓库(2026-08-20):https://github.com/ApodexAI/FrontierAgent

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手