AI圈报
论文研究普通

针对黑盒 LLM 的受控解码攻击框架

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:Controlled Decoding Attacks on Black-Box LLMs

内容摘要

研究者提出一种针对黑盒 LLM 的越狱框架,仅通过纯文本续写接口即可实施受控解码攻击,无需访问模型权重或 token 概率。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-b3ec5ddfdcd5c9f5cf943908