跳到正文
原文
OpenAI News·· 2024-12-20AI 评分54

OpenAI 推出 deliberative alignment 对齐策略,用推理提升 o1 模型安全性

Deliberative alignment: reasoning enables safer language models

AI 导读

OpenAI 介绍了面向 o1 模型的新对齐策略 deliberative alignment,称推理可以让语言模型更安全。该策略直接教模型安全规范,以及如何围绕这些规范进行推理。

来源:OpenAI News · openai.com