AI圈报
论文研究普通

自生成反馈会破坏测试时训练:长时程适应的因果分解

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:Self-Generated Feedback Destabilizes Test-Time Training: A Causal Decomposition of Long-Horizon Adaptation

内容摘要

研究在 128K token 流上发现,测试时训练(TTT)若保留模型自生成文本的权重更新,会损害其在独立人类文本上的预测能力,该现象在 125M、760M、3B 三种 TTT-E2E 配置以及 Adam 更新 Qwen3-4B 现有权重时均出现。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-7fd8edc81ea5c51ad59b7228