模型发布 / 更新精选
改进前沿 LLM 的指令层级
原始标题:Improving instruction hierarchy in frontier LLMs
内容摘要
IH-Challenge 训练模型优先处理可信指令,改进指令层级、安全可控性,并提升对提示词注入攻击的抵抗能力。
内容分类AI 模型发布与更新
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源OpenAI:官网动态(RSS · 排除企业/客户案例)
站内情报编号intel-fc23afdb502e7437fe5e8857