论文研究精选
OpenAI 报告存在可自我复制的提示词注入
原始标题:Self-replicating prompt injections exist
内容摘要
OpenAI 证明存在一种可像蠕虫一样自我传播的新型提示词注入,发现于 2026 年 6 月 27 日,基于 GPT-Red 自博弈红队训练,攻击模型基于 GPT-5.4-mini,受测模型包括 GPT-5.4-mini 和 GPT-5.5。
内容分类AI 论文与研究
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源OpenAI:失准报告与通报(网页)
站内情报编号intel-d07edbdfc3e522ee968b0f8a