AI圈报
观点 / 方法普通

OpenAI 报告自我复制提示词注入

信息来源:X:Rohan Paul (@rohanpaul_ai)·
原始标题:New incident reporting on OpenAI's official misalignment reporting site. Self-replicating prompt in…

内容摘要

OpenAI 官方失准报告网站上的新事件报告。 自我复制的提示词注入,能够有效地从一个 AI 交互传播到另一个 AI 交互。 恶意指令可以隐藏在 AI 读取的内容中,比如一封邮件,诱使 AI 去执行它,而不是只完成用户的任务。 巧妙之处在于,该指令还告诉 AI 把同一条恶意指令复制到它的回复中,从而可能暴露给下一个读取它的 AI。
内容分类AI 观点与方法
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Rohan Paul (@rohanpaul_ai)
站内情报编号intel-2f100e1ed0dcb4dc2c140fde