首个全栈国产GPU软件平台!龙芯加速计算平台发布:支持OpenCL/CUDA
  • 红茶
  • 2026年09月22日 11:08
  • 0

快科技9月22日消息,龙芯中科近日正式发布支持自研通用GPU的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本。

该平台基于龙芯2K3000及9A1000内集成的自研LG200系列通用GPU核心打造,实现了对算力芯片驱动、算力编程环境、AI模型推理等功能的全栈一体支持。

首个全栈国产GPU软件平台!龙芯加速计算平台发布:支持OpenCL/CUDA

平台核心组件包括推理引擎、高性能算子库、专用编译器、运行时环境、调试工具及性能分析套件,同时支持OpenCL 3.0与CUDA两类主流编程模型。

这意味着开发者可将基于CUDA开发的AI应用低成本迁移至龙芯平台,大幅降低国产算力生态的迁移门槛。

硬件层面,该平台覆盖龙芯全系列算力芯片,后续将与9A2000、9A3000等芯片同步演进,实现代际兼容。软件上支持Linux多内核版本,并已完成ONNX Runtime等主流深度学习框架的适配。

AI推理是平台的核心能力。龙芯自研的高性能推理引擎LacInfer通过算子融合、常量折叠等优化手段,可生成高度精简的计算图,充分释放GPU硬件性能。

在9A1000等芯片上,该平台已完成对目标检测、图像分割、姿态估计等主流AI模型的深度优化,推理精度损失处于行业领先水平。

应用场景上,该平台可服务于工业视觉、智能安防、智慧零售、车载感知等领域,目前已有部分早期客户基于2K3000及9A1000开展具身智能设备的研制。

首个全栈国产GPU软件平台!龙芯加速计算平台发布:支持OpenCL/CUDA

文章纠错

  • 好文点赞
  • 水文反对

此文章为快科技原创文章,快科技网站保留文章图片及文字内容版权,如需转载此文章请注明出处:快科技

观点发布 网站评论、账号管理说明
热门评论
查看全部评论
相关报道

最热文章排行查看排行详情

邮件订阅

评论0 | 点赞0| 分享0 | 收藏0