tilelang-vector-ascend-ops-migration
Installation
SKILL.md
TileLang GPU到NPU算子迁移 Skill
技能概述
本skill用于指导TileLang算子从GPU(CUDA)平台迁移到华为昇腾NPU平台。通过分析GPU实现,自动生成对应的NPU实现代码。
适用场景
- 将
gpu/目录下的TileLang算子迁移到npu/目录(或者说讲适配GPU的tilelang算子迁移为适配NPU的tilelang算子,如果用户没有说迁移到的算子放在哪里,就新建一个npu目录,放在npu目录下,并提示用户迁移算子的存放位置) - 自动适配NPU硬件约束和API差异
- 生成可直接运行的NPU算子代码
📚 重要参考文档
在迁移过程中,GPU 和 NPU 的 API 接口存在显著差异,强烈建议参考以下文档:
核心文档
docs/GPU-To-NPU-Migration-Methods.md- 详细迁移经验和案例