阿里发布原生全模态大模型 Qwen3.8-Omni-Flash:支持 1M 上下文,API 成本大幅下调

📡 IT之家2026-09-18 11:34

阿里推出原生全模态模型Qwen3.8-Omni-Flash,支持1M上下文与图文音视频处理,并大幅下调API成本。

AI 深度解读

2026 年 9 月 18 日,阿里千问上线原生全模态模型 Qwen3.8-Omni-Flash,在支持 1M 上下文的同时下调了多模态 API 接入资费。

  • 模型具备文本、图像、音频和视频的统一输入处理能力,上下文支持拓展至 1M Token,百万 Token 图文音视频输入定价为 0.8 元。
  • 官方评测数据显示,模型在 30 项基准测试中平均得分较上一代提升 26%,其中 AliMeeting 会议场景说话人错误率(DER)降至 3.35,AgenticVBench 提升 22.3 分。
  • 配套扩展了面向长程工作流的 Qwen-MM-Plugins,并开源了实时交互评测套件 Qwen-Live Harness 与图文笔记生成工具 Video2Note。
  • 同步推出的实时版本 Qwen3.8-Omni-Flash-Realtime 支持音视频流式输入与空间声源定位,可结合上下文调用外部工具。
  • 影响/看点:该模型通过降低长多模态交互成本与开源配套框架,有望推动会议摘要、短剧处理等音视频智能体落地,其实际市场表现取决于复杂工业场景下的泛化能力与推理稳定性。
  • 资料依据:
  • IT之家(2026-09-18):https://www.ithome.com/1/004/049.htm
  • Qwen开源项目仓库(2026-09-18):https://github.com/QwenLM/Qwen

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手