Rust SIMD on the GPU
vectorware.com原文 ↗
文章尝试把 Rust SIMD 风格映射到 GPU,让向量类型与熟悉的语言抽象承担并行表达,而不是要求每段逻辑都显式操作 block、warp 和 lane。难点在于 CPU SIMD 是程序声明向量,GPU 则以 SIMT warp 锁步执行;分支发散、lane 利用率、内存 coalescing 和同步语义都不能靠表面语法抹平。方向的价值是把 Rust 类型检查与现有库带到 GPU,但性能是否成立必须按 kernel 形状评估,抽象一致不等于硬件成本一致。
–浏览
评论 · Comments