Multiverse、 4-bit 圧縮モデルの 復元手法 QAH を 公開
要
AI要約
3行で- Multiverse Computing が圧縮モデルの復元手法 QAH を公開しました。
- GPT-OSS 120B を 60B に圧縮し MXFP4 に量子化しました。
- 9 ベンチマーク中 7 つで bfloat16 版を上回りました。
AI要約です。詳しくは出典へ。誤りを報告
Karunews が選んだ理由4-bit に圧縮したモデルが元の bfloat16 版を上回る結果と、その学習手順が原文で示されており、圧縮と復元の設計を考える材料になります。
典