您的位置首页 >人工智能 >

龙芯中科自研通用 GPU 加速计算平台首个软件版本正式发布

龙芯中科推出自研通用 GPU 加速计算平台首个软件版本,这套全栈算力软件体系可以为龙芯自研 LG200 系列通用 GPU 提供完整的软件支撑,补齐算力应用的软件配套能力,大幅降低 AI 应用迁移和开发门槛。这套加速计算平台依托龙芯 2K3000、9A1000 芯片内置的 LG200 系列自研通用 GPU 核心打造,在已有的 OpenGL、Vulkan 图形软件栈基础上,新增全套算力相关软件组件,打通从底层硬件驱动、编译运行环境到 AI 模型推理的完整开发链路。开发者可以直接使用平台配套工具完成算力调用、模型优化、应用部署整套工作,平台兼容主流编程接口,原有 CUDA 开发的 AI 应用能够低成本迁移到龙芯硬件上,适配工业视觉、智能安防、智慧零售等各类场景,助力国产算力生态持续完善。

平台核心组成组件

  • 算力底层驱动:统一抽象管理 GPU 硬件资源,支持多进程、多任务并发运行
  • 高性能推理引擎 LacInfer:使用算子融合、常量折叠等优化技术,充分释放 GPU 算力,可作为 ONNX Runtime 后端
  • 高性能算子库:内置 BLAS、DNN 算子库,满足 AI 推理计算需求
  • 专用编译器与运行时环境:负责任务调度、内存管理、事件同步
  • 配套工具套件:包含调试工具、性能分析工具,方便开发者调优程序

平台关键能力

  1. 编程接口支持:同时支持 OpenCL 3.0、CUDA 两类主流编程模型
  2. 深度学习框架适配:支持 ONNX 模型,PyTorch、TensorFlow 导出的模型可直接部署
  3. 硬件兼容:面向龙芯全系列算力芯片,后续可以和 9A2000、9A3000 芯片同步迭代,保持代际兼容
  4. 系统适配:支持多款 Linux 内核版本,适配龙架构软硬件环境

典型落地应用场景

表格

应用场景平台能力价值
工业视觉图像识别、缺陷检测 AI 推理加速
智能安防视频流目标检测、图像分析任务
智慧零售客流统计、商品识别类 AI 应用
车载感知实时感知计算,支持轻量化模型推理

【常见问题】

问题 1:龙芯中科自研通用 GPU 加速计算平台首个软件版本,适配哪些硬件芯片?

回答 1:龙芯中科自研通用 GPU 加速计算平台首个软件版本基于 LG200 系列通用 GPU 核心开发,适配龙芯 2K3000 和 9A1000 芯片,后续还可兼容 9A2000、9A3000 等新一代算力芯片。

问题 2:龙芯中科自研通用 GPU 加速计算平台首个软件版本,支持哪些编程模型?

回答 2:龙芯中科自研通用 GPU 加速计算平台首个软件版本支持 OpenCL 3.0 与 CUDA 两类主流编程模型,能够降低现有 CUDA 应用迁移至龙芯自研 GPU 环境的开发成本。

问题 3:龙芯中科自研通用 GPU 加速计算平台首个软件版本,自带的推理引擎有什么作用?

回答 3:龙芯中科自研通用 GPU 加速计算平台首个软件版本搭载 LacInfer 高性能推理引擎,通过算子融合等优化手段提升模型运行效率,可对接 ONNX Runtime,方便主流深度学习模型部署推理。

【数据来源】

[2026-09-22](龙芯发布自研通用 GPU 加速计算平台首个软件版本:支持 OpenCL 3.0、CUDA 及 AI 推理)新浪科技

[2026-09-22](首个全栈国产 GPU 软件平台!龙芯加速计算平台发布:支持 OpenCL/CUDA)太平洋科技

[2026-09-22](龙芯自研通用 GPU 加速计算平台首个软件版本面世)证券时报

免责声明:

本文仅作为技术资讯科普参考,相关产品功能、适配能力与应用效果以龙芯中科官方发布文档为准。

要不要我再精简一版短文案,适合直接发短视频配文?

免责声明:本文由用户上传,与本网站立场无关,如有侵权请联系删除!财经信息仅供读者参考,并不构成投资建议,投资者据此操作,风险自担。

今日大家都在搜的词: