登录社区云,与社区用户共同成长
邀请您加入社区
本场直播将围绕AutoFuse自动融合技术展开,介绍其如何在图编译阶段自动识别可融合算子、生成融合Kernel,降低算子调度与内存搬运开销等。内容面向昇腾NPU模型开发者、性能优化工程师及TensorFlow/PyTorch迁移用户,重点解决轻量算子多、Memory Bound明显、开启后如何验证收益等实际问题,帮助开发者快速理解原理、配置方法与性能分析路径。
1331
更多推荐
静态 Shape 多流并行增强:让图中的任务真正并行
CANN 开发者 Meetup 南京站|轻量开发专场,线下技术沙龙正式开启报名
代码侦探挑战赛(第三期)开启丨补全算子代码赢定制背包、冲锋衣等奖品!
扫一扫分享内容
为遵守国家网络实名制规定,未绑定将限制内容发布与互动
所有评论(0)