跳到正文
原文
OpenAI News·· 2025-08-05AI 评分34

OpenAI 估算开放权重 LLM gpt-oss 的最坏前沿风险

Estimating worst case frontier risks of open weight LLMs

AI 导读

OpenAI 研究发布 gpt-oss 可能带来的最坏前沿风险,重点评估开放权重 LLM 的潜在滥用能力。研究引入 malicious fine-tuning(MFT),通过在生物学和网络安全两个领域微调 gpt-oss,尝试诱发其最大能力。

来源:OpenAI News · openai.com