本文へ移動
10/7(水) 13:08
あとで読む
出典
研究Hugging Face Blog一次· 8/25(火)

Multiverse、4-bit 圧縮モデルの復元手法 QAH を公開

Hugging Face Blog
要

AI要約

3行で
  • Multiverse Computing が圧縮モデルの復元手法 QAH を公開しました。
  • GPT-OSS 120B を 60B に圧縮し MXFP4 に量子化しました。
  • 9 ベンチマーク中 7 つで bfloat16 版を上回りました。

AI要約です。詳しくは出典へ。誤りを報告

Karunews が選んだ理由4-bit に圧縮したモデルが元の bfloat16 版を上回る結果と、その学習手順が原文で示されており、圧縮と復元の設計を考える材料になります。

典

出典

1ソース · 一次情報
Hugging Face Blog一次Quantization-Aware Healing: a compressed, 4-bit model that outperforms its full-precision originalhuggingface.co
出典を読む