NVIDIA vLLM 首发即支持 DeepSeek V4.1 Flash 全系算力卡,AMD 适配仍待完善

📡 SemiAnalysis2026-09-12 04:00

NVIDIA vLLM首日即全面适配DeepSeek V4.1 Flash全系计算卡,而AMD版本适配仍在进行中。

AI 深度解读

在 DeepSeek V4.1 Flash 发布首日,NVIDIA 平台通过 vLLM 推理框架实现了全系列主流 GPU 的开箱即用支持,而 AMD 平台的适配生态仍面临运行障碍。

  • 根据 SemiAnalysis 与开源测试反馈,NVIDIA 联合 Inferact 团队实现了对 H100、H200、B200、B300、GB200 及 GB300 等 6 款计算硬件的首日兼容。
  • 适配涵盖了从 Hopper 到 Blackwell 架构的多代加速芯片,降低了开发者部署新模型的迁移成本与等待周期。
  • 对比之下,AMD 生态下的 vLLM 框架在 DeepSeek V4.1 Flash 上尚未能正常运行,显示出非英伟达硬件在开源模型首日适配速度上的生态差距。
  • 影响/看点:首日推理框架的兼容性优势有助于英伟达进一步巩固其在开源大模型部署领域的软硬件协同壁垒,AMD 能否缩小差距取决于其 ROCm 软件栈与开源社区的协同效率。
  • 资料依据:
  • X:SemiAnalysis (@SemiAnalysis_)(2026-09-11):https://x.com/SemiAnalysis_/status/2098501866401218813
  • vLLM 开源项目官方代码库(2026-09-11):https://github.com/vllm-project/vllm/releases

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手