OpenAI News·· 2025-08-07精选AI 评分62
OpenAI 介绍 GPT-5 的 safe-completions 输出中心安全训练方法
From hard refusals to safe-completions: toward output-centric safety training
AI 导读
OpenAI 介绍了 GPT-5 中新的 safe-completions 方法,用于在 AI 回答中同时改进安全性和有用性。该方法从硬拒绝转向更细致、以输出为中心的安全训练,用于处理双用途提示。
推荐理由
原文概述 GPT-5 的 safe-completions 训练取向,可作为理解双用途提示安全处理的背景。
来源:OpenAI News · openai.com