龙芯发布自研通用 GPU 加速计算平台首个软件版本
龙芯发布了面向自研 LG200 通用 GPU 的龙芯加速计算平台首个软件版本。平台覆盖底层驱动、编译器、运行时环境、资源管理、BLAS 和 DNN 算子库、调试与性能分析工具,以及 LacInfer 推理引擎,支持 OpenCL 3.0、CUDA 兼容编程接口和 ONNX Runtime。用户可将 PyTorch、TensorFlow 导出的 ONNX 模型直接部署到龙芯 GPU,无需额外转换或重写代码。龙芯已针对 9A1000、2K3000 等芯片优化目标检测、图像分割和姿态估计等计算机视觉模型。公司表示,相关软件已服务部分早期客户,并将随 9A2000、9A3000 等后续算力芯片持续演进。
本文来源:IT之家,仅供学习参考,版权归原作者所有。