龙芯发布自研通用 GPU 加速计算平台首个版本:兼容 CUDA 并支持 AI 推理
龙芯发布首个通用 GPU 加速计算平台软件版本,兼容 OpenCL 3.0 与 CUDA 并支持 AI 推理。
AI 深度解读
龙芯中科于 2026 年 9 月 22 日发布龙芯加速计算平台首个软件版本,通过提供涵盖底层驱动、编译环境与推理引擎的全栈工具链,完善其自研通用 GPU 的计算生态。
- 平台基于 2K3000 和 9A1000 所集成的 LG200 系列通用 GPU 核心开发,提供驱动、编译器、运行时环境与算子库等完整软件栈。
- 编程框架层面同时支持 OpenCL 3.0 和 CUDA 编程模型接口,降低已有并行计算程序的迁移与适配成本。
- AI 推理方面推出 LacInfer 推理引擎并作为 ONNX Runtime 执行后端,支持 PyTorch 等主流框架导出的 ONNX 模型直接部署,目前已应用于具身智能等开发场景。
- 影响/看点:该软件栈的推出为国产自主指令集芯片构建了通用计算支撑,可能加速龙芯硬件在边缘推理与嵌入式终端的落地,其商业普及取决于后续硬件算力性能及第三方算子生态的完善程度。
- 资料依据:
- IT之家(2026-09-22):https://www.ithome.com/1/005/595.htm
- 龙芯中科(2026-09-22):https://www.loongson.cn/news/show?id=2026092201
本内容由 AI 生成,仅供参考,请注意甄别