OpenAI News·· 2024-12-20AI 评分54
OpenAI 推出 deliberative alignment 对齐策略,用推理提升 o1 模型安全性
Deliberative alignment: reasoning enables safer language models
AI 导读
OpenAI 介绍了面向 o1 模型的新对齐策略 deliberative alignment,称推理可以让语言模型更安全。该策略直接教模型安全规范,以及如何围绕这些规范进行推理。
来源:OpenAI News · openai.com