论文研究普通
Where-OPD:用合成场景对 MLLM 做空间引导的在线自蒸馏
原始标题:Where-OPD: Spatially Guided On-Policy Self-Distillation of MLLMs with Synthetic Scenes
内容摘要
Where-OPD 提出一种面向多模态大模型(MLLM)的在线自蒸馏方法,让教师模型获得文本形式的空间定位引导,从而定位并整合多个相关图像区域的证据,学生模型仅凭图像和问题学习复现该行为。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-373c29e755c01a7f2be907cb