跳到正文
热点事件持续更新

BACON:多模态KV缓存压缩校准方法

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

Tianhao Chen等作者提出一种即插即用的多模态KV缓存压缩方法BACON,针对多模态大语言模型在长视觉上下文下KV cache过大、解码延迟高的问题。该方法用last query attention校准observation window attention,并通过层内一致性与层间持续性抑制噪声。 上述内容来自作者在论文中的自述,尚未见独立验证或与其他方法的效果对比。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月5日
  1. arXiv:cs.CL
    BACON:面向多模态 KV Cache 压缩的边界注意力校准方法

    针对多模态大语言模型长视觉上下文下 KV cache 过大、解码延迟高的问题,研究者提出即插即用方法 BACON,用 last query attention 校准 observation window attention,并通过层内一致性与层间持续性抑制噪声。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。