论文研究精选
OpenAI 介绍 GPT-5 的 safe-completions 输出中心安全训练方法
原始标题:From hard refusals to safe-completions: toward output-centric safety training
内容摘要
OpenAI 发布文章,介绍 GPT-5 采用的 safe-completions 方法,用以输出为中心的安全训练取代硬拒答。该方法针对双用途提示词给出更细致的回应,兼顾安全性与有用性。
内容分类AI 论文与研究
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源OpenAI:官网动态(RSS · 排除企业/客户案例)
站内情报编号intel-5cfd818f5f77de72f7daf9fb