龙芯发布自研GPU加速计算平台首个软件版本

IT时代网9月22日消息,龙芯中科今日推出龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本,面向自研通用GPU提供从底层驱动、编程环境到AI模型推理的完整软件支持。该平台基于龙芯2K3000与9A1000芯片集成的LG200系列通用GPU核心开发。

在已有OpenGL、Vulkan图形软件栈之上,平台补齐了算力芯片驱动、编译器、运行时、算子库、推理引擎、调试与性能分析工具等组件,并同时支持OpenCL 3.0与CUDA两类编程模型接口。这意味着开发者基于CUDA开发的AI应用,可低成本迁移到龙芯平台。

推理方面,龙芯拿出自研高性能引擎LacInfer,通过算子融合、常量折叠等方式优化计算图,减少数据访存。算子库已覆盖基础线性代数与神经网络计算,其中矩阵乘法等核心算子做了汇编级优化。

平台支持ONNX Runtime,并把LacInfer作为其后端,用户可直接把PyTorch、TensorFlow导出的ONNX模型部署到龙芯GPU,无需重写代码。硬件上覆盖龙芯全系列算力芯片与Linux多内核版本,后续将随9A2000、9A3000等芯片演进保持代际兼容。龙芯称相关算力软件已服务部分早期客户,并基于2K3000、9A1000开展了多款具身智能设备的智能体研发。

注:本文配图由AI生成,文中包含AI辅助创作的内容。

编辑:林一舟

THE END