OpenAI News·· 2025-08-05AI 评分34
OpenAI 估算开放权重 LLM gpt-oss 的最坏前沿风险
Estimating worst case frontier risks of open weight LLMs
AI 导读
OpenAI 研究发布 gpt-oss 可能带来的最坏前沿风险,重点评估开放权重 LLM 的潜在滥用能力。研究引入 malicious fine-tuning(MFT),通过在生物学和网络安全两个领域微调 gpt-oss,尝试诱发其最大能力。
来源:OpenAI News · openai.com