阿里通义千问 Qwen3.8-Flash 正式上线:百万 Token 仅 0.15 美元起
阿里通义千问 Qwen3.8-Flash 在 QwenCloud 上线,支持最高 1M 上下文,输入定价每百万 Token 0.15 美元。
AI 深度解读
阿里巴巴通义千问团队于 2026 年 8 月在 QwenCloud 上线 Qwen3.8-Flash API,其低价的模型调用与缓存命中策略为长上下文处理和高频应用部署提供了更经济的选择。
- 定价结构:QwenCloud 官方数据显示,该模型输入价格为每百万 Token 0.15 美元,输出价格为每百万 Token 0.47 美元,Prompt 缓存命中时输入单价降至每百万 Token 0.016 美元。
- 架构与上下文:该模型支持原生 262K 上下文窗口并可扩展至 1M Token,底层采用混合注意力机制与 125B 总参数(单 Token 激活 6B)的稀疏专家(MoE)结构。
- 场景适配:官方将其定位为生产级模型,通过内置工具调用能力与低单价设计,主要面向长文本解析与批量 Agent 协同场景。
- 影响/看点:若企业在实际业务中保持较高的 Prompt 缓存复用率,该定价机制有望显著压缩模型调用的算力开销,但实际效果取决于其在复杂任务中的推理准确率。
- 资料依据:
- 1. 通义千问官方 X 账号公告(2026 年 8 月,https://x.com/Alibaba_Qwen/status/2092867093385613760)
- 2. Qwen 官方文档与 Hugging Face 页面(2026 年 8 月,https://huggingface.co/Qwen)
本内容由 AI 生成,仅供参考,请注意甄别