聯繫我們

課程簡介

中国AI GPU生态系统概览

  • 华为昇腾、壁仞、寒武纪MLU对比
  • CUDA与CANN、壁仞SDK及BANGPy模型
  • 行业趋势与厂商生态

迁移准备

  • 评估您的CUDA代码库
  • 确定目标平台与SDK版本
  • 工具链安装与环境配置

代码翻译技术

  • 移植CUDA内存访问与内核逻辑
  • 映射计算网格/线程模型
  • 自动与手动翻译方案选择

平台专属实现

  • 使用华为CANN算子与自定义内核
  • 壁仞SDK转换流程
  • 使用BANGPy(寒武纪)重建模型

跨平台测试与优化

  • 在各目标平台上进行性能分析
  • 内存调优与并行执行对比
  • 性能跟踪与迭代

混合GPU环境管理

  • 多架构混合部署
  • 回退策略与设备检测
  • 用于代码可维护性的抽象层

案例研究与最佳实践

  • 将视觉/NLP模型移植至昇腾或寒武纪
  • 在壁仞集群上改造推理流水线
  • 处理版本不匹配与API缺口

总结与后续步骤

最低要求

  • 具备CUDA或基于GPU的应用程序编程经验
  • 理解GPU内存模型与计算内核
  • 熟悉AI模型部署或加速工作流

目标受众

  • GPU程序员
  • 系统架构师
  • 移植专家
 21 小時

人數


每位參與者的報價

即將到來的課程

課程分類