平台覆盖驱动、编译器、算子库和推理引擎,并兼容OpenCL 3.0与CUDA接口。
推荐理由:龙芯首次补齐自研GPU从驱动、编译器到算子库与推理引擎的软件栈,并以API兼容CUDA降低迁移门槛;但缺少性能数据,生态成熟度仍待验证。
阅读原文