感谢您发送咨询!我们的团队成员将很快与您联系。
感谢您发送预订!我们的团队成员将很快与您联系。
课程大纲
中国AI GPU生态系统概述
- 华为昇腾、壁仞、寒武纪MLU对比
- CUDA与CANN、壁仞SDK及BANGPy模型对比
- 行业趋势和供应商生态系统
迁移准备
- 评估您的CUDA代码库
- 确定目标平台和SDK版本
- 工具链安装和环境设置
代码转换技术
- 移植CUDA内存访问和内核逻辑
- 映射计算网格/线程模型
- 自动化与手动转换选项
特定平台实现
- 使用华为CANN算子和自定义内核
- 壁仞SDK转换流程
- 使用BANGPy(寒武纪)重建模型
跨平台测试与优化
- 在每个目标平台上分析执行
- 内存调优和并行执行比较
- 性能跟踪与迭代
管理混合GPU环境
- 多架构混合部署
- 回退策略和设备检测
- 代码可维护性的抽象层
案例研究和最佳实践
- 将视觉/NLP模型移植到昇腾或寒武纪
- 在壁仞集群上改造推理流水线
- 处理版本不匹配和API差距
总结和后续步骤
要求
- 具备CUDA或GPU应用编程经验
- 理解GPU内存模型和计算内核
- 熟悉AI模型部署或加速工作流程
目标学员
- GPU程序员
- 系统架构师
- 移植专家
21 小时