联系我们

课程大纲

中国AI GPU生态系统概述

  • 华为昇腾、壁仞、寒武纪MLU对比
  • CUDA与CANN、壁仞SDK及BANGPy模型对比
  • 行业趋势和供应商生态系统

迁移准备

  • 评估您的CUDA代码库
  • 确定目标平台和SDK版本
  • 工具链安装和环境设置

代码转换技术

  • 移植CUDA内存访问和内核逻辑
  • 映射计算网格/线程模型
  • 自动化与手动转换选项

特定平台实现

  • 使用华为CANN算子和自定义内核
  • 壁仞SDK转换流程
  • 使用BANGPy(寒武纪)重建模型

跨平台测试与优化

  • 在每个目标平台上分析执行
  • 内存调优和并行执行比较
  • 性能跟踪与迭代

管理混合GPU环境

  • 多架构混合部署
  • 回退策略和设备检测
  • 代码可维护性的抽象层

案例研究和最佳实践

  • 将视觉/NLP模型移植到昇腾或寒武纪
  • 在壁仞集群上改造推理流水线
  • 处理版本不匹配和API差距

总结和后续步骤

要求

  • 具备CUDA或GPU应用编程经验
  • 理解GPU内存模型和计算内核
  • 熟悉AI模型部署或加速工作流程

目标学员

  • GPU程序员
  • 系统架构师
  • 移植专家
 21 小时

即将举行的公开课程

课程分类