跳到正文
Berkeley AI Research·· 2026-07-29精选AI 评分74

K-Search 如何将 CUDA 内核优化经验迁移到 Apple Silicon

From CUDA to MLX: How K-Search Brings Decades of Kernel Expertise to Apple Silicon

AI 导读

Berkeley AI Research 团队为 K-Search 增加 MLX 后端和 CUDA-to-MLX 翻译层,使其能将现有 CUDA 内核作为知识基础,为 Apple Silicon 搜索优化内核。

推荐理由

文章拆解了 CUDA 优化知识迁移到 MLX 的结构化做法,并用 Attention 与 Mamba SSM 两类内核的实测数据展示其性能差异。

来源:Berkeley AI Research · bair.berkeley.edu