本场直播将围绕AutoFuse自动融合技术展开,介绍其如何在图编译阶段自动识别可融合算子、生成融合Kernel,降低算子调度与内存搬运开销等。内容面向昇腾NPU模型开发者、性能优化工程师及TensorFlow/PyTorch迁移用户,重点解决轻量算子多、Memory Bound明显、开启后如何验证收益等实际问题,帮助开发者快速理解原理、配置方法与性能分析路径。

Logo

1331

更多推荐