跳到正文
原文
Hugging Face:Blog(RSS)·· 2026-08-25AI 评分55

Multiverse Computing 提出 Quantization-Aware Healing:60B 4-bit 模型在 9 项基准中 7 项反超全精度原版

Quantization-Aware Healing: a compressed, 4-bit model that outperforms its full-precision original

AI 导读

Multiverse Computing 发布论文 Quantization-Aware Healing(QAH),将 GPT-OSS 120B 压缩到 60B 参数并量化为 MXFP4 后,直接从压缩前的原始模型做 KL 蒸馏。

来源:Hugging Face:Blog(RSS) · huggingface.co