OpenAI·· 2025-08-07AI 评分42
OpenAI 从硬性拒绝转向安全补全:迈向以输出为中心的安全训练
From hard refusals to safe-completions: toward output-centric safety training
AI 导读
OpenAI 在 GPT-5 中引入了全新的 safe-completions 方法,通过以输出为中心的安全训练来处理双重用途提示词(dual-use prompts)。该方法摆脱了以往一刀切式的硬性拒绝(hard refusals),在提供更细致回复的同时,兼顾并提升了 AI 回答应答的安全性与实用性。
来源:OpenAI · openai.com