快科技9月22日消息,龙芯中科近日正式发布支持自研通用GPU的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本。
该平台基于龙芯2K3000及9A1000内集成的自研LG200系列通用GPU核心打造,实现了对算力芯片驱动、算力编程环境、AI模型推理等功能的全栈一体支持。
平台核心组件包括推理引擎、高性能算子库、专用编译器、运行时环境、调试工具及性能分析套件,同时支持OpenCL 3.0与CUDA两类主流编程模型。
这意味着开发者可将基于CUDA开发的AI应用低成本迁移至龙芯平台,大幅降低国产算力生态的迁移门槛。
硬件层面,该平台覆盖龙芯全系列算力芯片,后续将与9A2000、9A3000等芯片同步演进,实现代际兼容。软件上支持Linux多内核版本,并已完成ONNX Runtime等主流深度学习框架的适配。
AI推理是平台的核心能力。龙芯自研的高性能推理引擎LacInfer通过算子融合、常量折叠等优化手段,可生成高度精简的计算图,充分释放GPU硬件性能。
在9A1000等芯片上,该平台已完成对目标检测、图像分割、姿态估计等主流AI模型的深度优化,推理精度损失处于行业领先水平。
应用场景上,该平台可服务于工业视觉、智能安防、智慧零售、车载感知等领域,目前已有部分早期客户基于2K3000及9A1000开展具身智能设备的研制。



