阿里发布原生全模态大模型 Qwen3.8-Omni-Flash:支持 1M 上下文,API 成本大幅下调
阿里推出原生全模态模型Qwen3.8-Omni-Flash,支持1M上下文与图文音视频处理,并大幅下调API成本。
AI 深度解读
2026 年 9 月 18 日,阿里千问上线原生全模态模型 Qwen3.8-Omni-Flash,在支持 1M 上下文的同时下调了多模态 API 接入资费。
- 模型具备文本、图像、音频和视频的统一输入处理能力,上下文支持拓展至 1M Token,百万 Token 图文音视频输入定价为 0.8 元。
- 官方评测数据显示,模型在 30 项基准测试中平均得分较上一代提升 26%,其中 AliMeeting 会议场景说话人错误率(DER)降至 3.35,AgenticVBench 提升 22.3 分。
- 配套扩展了面向长程工作流的 Qwen-MM-Plugins,并开源了实时交互评测套件 Qwen-Live Harness 与图文笔记生成工具 Video2Note。
- 同步推出的实时版本 Qwen3.8-Omni-Flash-Realtime 支持音视频流式输入与空间声源定位,可结合上下文调用外部工具。
- 影响/看点:该模型通过降低长多模态交互成本与开源配套框架,有望推动会议摘要、短剧处理等音视频智能体落地,其实际市场表现取决于复杂工业场景下的泛化能力与推理稳定性。
- 资料依据:
- IT之家(2026-09-18):https://www.ithome.com/1/004/049.htm
- Qwen开源项目仓库(2026-09-18):https://github.com/QwenLM/Qwen
本内容由 AI 生成,仅供参考,请注意甄别