V-CoLA:面向线性注意力的免训练视觉token压缩框架
热点事件观察中
V-CoLA:面向线性注意力的免训练视觉token压缩框架
1 篇报道1 个报道来源1 天前更新
先了解这件事
AI 综述
V-CoLA 论文作者提出一种免训练的视觉 token 压缩框架,专为线性注意力混合架构(如 Qwen3.5)设计,包含独特性感知重要性判据与自适应 token 合并策略,并在实现层面兼容线性注意力的分块并行。 论文作者称,实验中该框架仅用 50.0% 视觉 token 即达到原始性能的 99.5%,用 12.5% token 仍保留 88.0% 以上性能,prefill 加速 1.86 至 6.15 倍。
AI 根据报道生成 · 1 小时前更新
最新进展10月8日 08:00
V-CoLA:面向线性注意力的视觉 token 压缩框架报道时间线
沿着报道,了解事件的不同侧面。
10月8日
- Hugging Face 每日论文V-CoLA:面向线性注意力的视觉 token 压缩框架
V-CoLA 提出一种免训练的视觉 token 压缩框架,专为线性注意力混合架构(如 Qwen3.5)设计,包含独特性感知重要性判据与自适应 token 合并策略,并在实现层面兼容线性注意力的分块并行。实验显示它仅用 50.0% 视觉 token 即可达到原始性能的 99.5%,用 12.5% token 仍保留 88.0% 以上性能,prefill 加速 1.86 至 6.15 倍。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。