17173首页 游戏资讯 科技新闻 正文

首个全栈国产GPU软件平台!龙芯加速计算平台发布:支持OpenCL/CUDA

导语
首个全栈国产GPU软件平台!龙芯加速计算平台发布,支持OpenCL 3.0与CUDA,AI应用低成本迁移,降低国产算力门槛,覆盖工业视觉、智能安防等场景。

龙芯中科近日正式发布支持自研通用GPU的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本。

该平台基于龙芯2K3000及9A1000内集成的自研LG200系列通用GPU核心打造,实现了对算力芯片驱动、算力编程环境、AI模型推理等功能的全栈一体支持。

平台核心组件包括推理引擎、高性能算子库、专用编译器、运行时环境、调试工具及性能分析套件,同时支持OpenCL 3.0与CUDA两类主流编程模型。

这意味着开发者可将基于CUDA开发的AI应用低成本迁移至龙芯平台,大幅降低国产算力生态的迁移门槛。

硬件层面,该平台覆盖龙芯全系列算力芯片,后续将与9A2000、9A3000等芯片同步演进,实现代际兼容。软件上支持Linux多内核版本,并已完成ONNX Runtime等主流深度学习框架的适配。

AI推理是平台的核心能力。龙芯自研的高性能推理引擎LacInfer通过算子融合、常量折叠等优化手段,可生成高度精简的计算图,充分释放GPU硬件性能。

在9A1000等芯片上,该平台已完成对目标检测、图像分割、姿态估计等主流AI模型的深度优化,推理精度损失处于行业领先水平。

应用场景上,该平台可服务于工业视觉、智能安防、智慧零售、车载感知等领域,目前已有部分早期客户基于2K3000及9A1000开展具身智能设备的研制。

【来源:快科技】

尊敬的用户也许你已经注意到了我们文章页面进行了大规模的改造和重构,可以点击提交您的满意度或者想法我们会持续改进,给您提供更好的浏览体验! 一键参与
17173APP

扫描下载APP

游戏礼包一键领取

17173微信公众号

扫描关注公众号

每天更新