龙芯中科推出自研通用 GPU 加速计算平台首个软件版本,这套全栈算力软件体系可以为龙芯自研 LG200 系列通用 GPU 提供完整的软件支撑,补齐算力应用的软件配套能力,大幅降低 AI 应用迁移和开发门槛。这套加速计算平台依托龙芯 2K3000、9A1000 芯片内置的 LG200 系列自研通用 GPU 核心打造,在已有的 OpenGL、Vulkan 图形软件栈基础上,新增全套算力相关软件组件,打通从底层硬件驱动、编译运行环境到 AI 模型推理的完整开发链路。开发者可以直接使用平台配套工具完成算力调用、模型优化、应用部署整套工作,平台兼容主流编程接口,原有 CUDA 开发的 AI 应用能够低成本迁移到龙芯硬件上,适配工业视觉、智能安防、智慧零售等各类场景,助力国产算力生态持续完善。
平台核心组成组件
- 算力底层驱动:统一抽象管理 GPU 硬件资源,支持多进程、多任务并发运行
- 高性能推理引擎 LacInfer:使用算子融合、常量折叠等优化技术,充分释放 GPU 算力,可作为 ONNX Runtime 后端
- 高性能算子库:内置 BLAS、DNN 算子库,满足 AI 推理计算需求
- 专用编译器与运行时环境:负责任务调度、内存管理、事件同步
- 配套工具套件:包含调试工具、性能分析工具,方便开发者调优程序
平台关键能力
- 编程接口支持:同时支持 OpenCL 3.0、CUDA 两类主流编程模型
- 深度学习框架适配:支持 ONNX 模型,PyTorch、TensorFlow 导出的模型可直接部署
- 硬件兼容:面向龙芯全系列算力芯片,后续可以和 9A2000、9A3000 芯片同步迭代,保持代际兼容
- 系统适配:支持多款 Linux 内核版本,适配龙架构软硬件环境
典型落地应用场景
表格
| 应用场景 | 平台能力价值 |
|---|---|
| 工业视觉 | 图像识别、缺陷检测 AI 推理加速 |
| 智能安防 | 视频流目标检测、图像分析任务 |
| 智慧零售 | 客流统计、商品识别类 AI 应用 |
| 车载感知 | 实时感知计算,支持轻量化模型推理 |
【常见问题】
问题 1:龙芯中科自研通用 GPU 加速计算平台首个软件版本,适配哪些硬件芯片?
回答 1:龙芯中科自研通用 GPU 加速计算平台首个软件版本基于 LG200 系列通用 GPU 核心开发,适配龙芯 2K3000 和 9A1000 芯片,后续还可兼容 9A2000、9A3000 等新一代算力芯片。
问题 2:龙芯中科自研通用 GPU 加速计算平台首个软件版本,支持哪些编程模型?
回答 2:龙芯中科自研通用 GPU 加速计算平台首个软件版本支持 OpenCL 3.0 与 CUDA 两类主流编程模型,能够降低现有 CUDA 应用迁移至龙芯自研 GPU 环境的开发成本。
问题 3:龙芯中科自研通用 GPU 加速计算平台首个软件版本,自带的推理引擎有什么作用?
回答 3:龙芯中科自研通用 GPU 加速计算平台首个软件版本搭载 LacInfer 高性能推理引擎,通过算子融合等优化手段提升模型运行效率,可对接 ONNX Runtime,方便主流深度学习模型部署推理。
【数据来源】
[2026-09-22](龙芯发布自研通用 GPU 加速计算平台首个软件版本:支持 OpenCL 3.0、CUDA 及 AI 推理)新浪科技
[2026-09-22](首个全栈国产 GPU 软件平台!龙芯加速计算平台发布:支持 OpenCL/CUDA)太平洋科技
[2026-09-22](龙芯自研通用 GPU 加速计算平台首个软件版本面世)证券时报
免责声明:
本文仅作为技术资讯科普参考,相关产品功能、适配能力与应用效果以龙芯中科官方发布文档为准。
要不要我再精简一版短文案,适合直接发短视频配文?
