AI圈报
论文研究普通

Adaptive Reward Routing:面向联合音视频扩散模型的前向过程 RL 动态多奖励优化

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:Adaptive Reward Routing: Dynamic Multi-Reward Optimization for Joint Audio-Video Diffusion via Forward-Process RL

内容摘要

针对联合音视频扩散模型的多奖励强化学习,研究者提出 Adaptive Reward Routing,在 DiffusionNFT 前向过程 RL 中同时自适应调整更新位置与奖励协调方式。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-1b16490a971d784c742da24f