本文へ移動
10/7(水) 13:08
あとで読む
出典
研究Berkeley AI Research一次· 7/29(水)

K-Search、CUDA 知識を MLX に移植

Berkeley AI Research
要

AI要約

3行で
  • K-Search を MLX に拡張する手法が公開されました。
  • CUDA の最適化知識を Apple Silicon 向けに変換します。
  • Mamba カーネルの prefill は約 20 倍高速です。

AI要約です。詳しくは出典へ。誤りを報告

Karunews が選んだ理由CUDA の最適化知識を Apple Silicon 向けに移す手法と、Mamba カーネルで約 20 倍の prefill 高速化という結果が示されています。

典

出典

1ソース · 一次情報
Berkeley AI Research一次From CUDA to MLX: How K-Search Brings Decades of Kernel Expertise to Apple Siliconbair.berkeley.edu
出典を読む