论文研究普通
CE-GRPO 提出信用可寻址推理,提升多模态几何推理准确率
原始标题:Learning Where Outcomes Change:Credit-Addressable Reasoning for Multimodal Geometry
内容摘要
论文提出 credit-addressable reasoning 框架,用 Code-CoT 将视觉关系表示为可执行代码并组织为类型化事件,CE-GRPO 在事件边界上做局部优势分配。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-23642a066b12dcf5db80bbf0