跳到正文
原文
OpenAI News·· 2025-08-07精选AI 评分62

OpenAI 介绍 GPT-5 的 safe-completions 输出中心安全训练方法

From hard refusals to safe-completions: toward output-centric safety training

AI 导读

OpenAI 介绍了 GPT-5 中新的 safe-completions 方法,用于在 AI 回答中同时改进安全性和有用性。该方法从硬拒绝转向更细致、以输出为中心的安全训练,用于处理双用途提示。

推荐理由

原文概述 GPT-5 的 safe-completions 训练取向,可作为理解双用途提示安全处理的背景。

来源:OpenAI News · openai.com