跳到正文
原文
OpenAI·· 2025-08-07AI 评分42

OpenAI 从硬性拒绝转向安全补全:迈向以输出为中心的安全训练

From hard refusals to safe-completions: toward output-centric safety training

AI 导读

OpenAI 在 GPT-5 中引入了全新的 safe-completions 方法,通过以输出为中心的安全训练来处理双重用途提示词(dual-use prompts)。该方法摆脱了以往一刀切式的硬性拒绝(hard refusals),在提供更细致回复的同时,兼顾并提升了 AI 回答应答的安全性与实用性。

来源:OpenAI · openai.com