Berkeley AI Research·· 2026-07-29精选AI 评分74
K-Search 如何将 CUDA 内核优化经验迁移到 Apple Silicon
From CUDA to MLX: How K-Search Brings Decades of Kernel Expertise to Apple Silicon
AI 导读
Berkeley AI Research 团队为 K-Search 增加 MLX 后端和 CUDA-to-MLX 翻译层,使其能将现有 CUDA 内核作为知识基础,为 Apple Silicon 搜索优化内核。
推荐理由
文章拆解了 CUDA 优化知识迁移到 MLX 的结构化做法,并用 Attention 与 Mamba SSM 两类内核的实测数据展示其性能差异。
来源:Berkeley AI Research · bair.berkeley.edu