AI圈报
论文研究普通

CoVeR:面向 VLM 多视图 3D 推理的基于覆盖率的 token 剪枝方法

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:CoVeR: Coverage-Based Token Pruning for Multi-View 3D Reasoning in VLMs

内容摘要

CoVeR 是一种无需训练的确定性视觉 token 选择器,仅利用 token 坐标实现场景全覆盖,以解决多视图 3D 推理中现有剪枝方法的冗余与预算限制问题。在三个 3D 推理基准上,CoVeR 均超越此前 SOTA,并可作为即插即用模块适配四种 VLM。仅保留约 8% 的视觉 token,即可维持全量 token 93.5% 的性能,平均超出 SOTA 3.9 个百分点。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-18dbdc8ff4192c3a1888f8c6