AI圈报
论文研究普通

LVMT:面向长时视频分割的视频掩码 Transformer

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:LVMT: Video Mask Transformer for Long-term Video Segmentation

内容摘要

研究者提出长时视频掩码 Transformer(LVMT),用轻量 GRU 时序传播模块自适应选择跨时间保留的对象信息,并引入 Truncated Query Propagation(TQP)训练策略,按帧块处理视频、仅在块内反向传播,从而在长视频上实现更长时序监督且不爆显存。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-fa01ef0117f48b15a6192cd7