【龙芯加速计算平台发布】近日,龙芯中科正式发布支持自研通用GPU的龙芯加速计算平台首个软件版本。该平台基于龙芯2K3000及9A1000内集成的自研LG200系列通用GPU核心打造,实现了对算力芯片驱动、算力编程环境、AI模型推理等功能的全栈一体支持。平台核心组件包括推理引擎、高性能算子库、专用编译器、运行时环境、调试工具及性能分析套件,同时支持OpenCL 3.0与CUDA两类主流编程模型。这意味着开发者可将基于CUDA开发的AI应用低成本迁移至龙芯平台,大幅降低国产算力生态的迁移门槛。
硬件层面,该平台覆盖龙芯全系列算力芯片,后续将与9A2000、9A3000等芯片同步演进,实现代际兼容。软件上支持Linux多内核版本,并已完成ONNX Runtime等主流深度学习框架的适配。
