论文研究普通
QwenGyre:面向超长程智能体训练的弹性强化学习框架
原始标题:QwenGyre: An Elastic Reinforcement Learning Framework for Training xLong-Horizon Agents
内容摘要
阿里发布 QwenGyre,一个面向超长程(xlong-horizon)智能体在线强化学习的端到端框架,可在不中断执行的情况下弹性重分配 GPU,并通过轨迹处理器去重冗余分支路径。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-bc451753b948f70096fd8eac