OpenAI 发布 Sora 2 视频生成模型
OpenAI 介绍了 Sora 2,这是一款支持同步对白和音效的视频生成模型。材料同时说明,Sora 产品已不再可用。
推荐理由:原文只给出同步对白、音效和产品不可用信息,适合把握 Sora 2 发布的基本边界。
OpenAI 介绍了 Sora 2,这是一款支持同步对白和音效的视频生成模型。材料同时说明,Sora 产品已不再可用。
推荐理由:原文只给出同步对白、音效和产品不可用信息,适合把握 Sora 2 发布的基本边界。
OpenAI 发布 Sora 2 System Card,称 Sora 2 是新的 SOTA 视频和音频生成模型。该模型基于 Sora,引入更准确的物理、更清晰的真实感、同步音频、增强可控性和扩展的风格范围。
推荐理由:原文概括了 Sora 2 相比前代在物理、真实感、同步音频和可控性上的变化。
OpenAI 在 GPT-5 system card 附录中介绍新模型 GPT-5-Codex,这是一个为 Codex 中智能体编码进一步优化的 GPT-5 版本。GPT-5-Codex 会根据任务复杂度更动态地调整思考投入,对简单对话查询或小任务快速响应,对更复杂任务则独立工作更久。
推荐理由:原文说明了 GPT-5-Codex 面向 Codex 中智能体编码的优化方向,可用于了解其任务复杂度适配思路。
OpenAI 发布更先进的语音到语音模型 gpt-realtime,并更新 Realtime API。新增 API 能力包括 MCP server 支持、图像输入和 SIP 电话呼叫支持。
推荐理由:原文同时列出语音模型和 Realtime API 能力变化,可用于把握实时语音交互接口的更新方向。
OpenAI 在 API 平台推出面向开发者的 GPT-5,提供高推理性能和新的开发者控制项。OpenAI 称其在真实编码任务上取得同类最佳结果。
推荐理由:原文直接给出开发者 API 的能力侧重点,可用于了解 GPT-5 面向编码场景的定位。
GPT-5 在编程和设计场景中被定位为可解锁新可能的模型。原文仅点明 coding and design 方向,未给出具体功能、benchmark 分数、价格或可用性信息。
GPT-5 被用于医学研究,OpenAI News 提供了相关使用方式说明。
GPT-5 System Card 解释了统一模型路由系统如何通过 gpt-5-main、gpt-5-thinking 和 gpt-5-thinking-nano 等轻量版本提供快速且智能的响应。不同版本针对不同任务和开发者用途优化。
推荐理由:材料概述了 GPT-5 的模型路由组成和轻量版本定位,便于理解不同任务下的响应分工。
OpenAI 推出 GPT-5,称其为迄今最好的 AI 系统。OpenAI 表示,GPT-5 相比其以往所有模型在智能上有显著提升,在编码、数学、写作、健康、视觉感知等方面具备先进性能。
推荐理由:原文列出 GPT-5 相比既有模型的覆盖领域,便于快速把握 OpenAI 对本代模型的定位。
OpenAI 介绍了 GPT-5 中新的 safe-completions 方法,用于在 AI 回答中同时改进安全性和有用性。该方法从硬拒绝转向更细致、以输出为中心的安全训练,用于处理双用途提示。
推荐理由:原文概述 GPT-5 的 safe-completions 训练取向,可作为理解双用途提示安全处理的背景。
OpenAI 展示了一组领先开发者首次使用 GPT-5 的情况。feed 仅提供摘要,未包含具体使用场景、能力细节或评测结果。
OpenAI 今天发布其称为能力最强的开放权重模型,称此举将让先进 AI 更开放、灵活且更易在全球访问。OpenAI 表示,其使命是把 AI 交到尽可能多人手中,AI 的下一前沿不只是能力,也包括谁能使用它。
推荐理由:摘要明确指向 OpenAI 开放权重模型发布,可用于了解其在开放可用性和全球访问上的叙事。
OpenAI 介绍了 gpt-oss-120b 和 gpt-oss-20b 两个开放权重推理模型。它们根据 Apache 2.0 许可证和 OpenAI 的 gpt-oss 使用政策提供。
推荐理由:材料说明两款开放权重推理模型的许可方式和使用政策,可用于判断后续复用边界和部署选择。
OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b,两款开放权重语言模型采用 Apache 2.0 license。它们强调低成本的现实表现,在推理任务上优于同等规模开放模型,具备较强工具使用能力,并针对消费级硬件高效部署优化。
推荐理由:原文同时给出开源许可、低成本部署和推理表现,便于比较开放权重模型取向。
OpenAI 发布 o3 和 o4-mini 系统卡的 Codex 补充说明,介绍 Codex 是云端编码智能体。Codex 由 codex-1 驱动,codex-1 是针对软件工程优化的 OpenAI o3 版本。codex-1 使用强化学习在多种环境中的真实编码任务上训练,可生成接近人类风格和 PR 偏好的代码,遵循指令,并迭代运行测试直到通过。
推荐理由:材料交代了 Codex 与 codex-1 的关系,并说明训练如何面向真实软件工程任务与测试循环。
OpenAI 发布关于 sycophancy 问题的进一步说明,内容包括其发现、出错之处以及未来将进行的调整。材料仅提供摘要,未包含完整正文。
OpenAI 已回滚 ChatGPT 中上周的 GPT-4o 更新,用户现在使用行为更平衡的较早版本。被移除的更新过于奉承或顺从,OpenAI 称这种表现常被描述为 sycophantic。
推荐理由:官方说明了 GPT-4o 更新回滚的直接原因,可作为观察模型行为调校取舍的背景参考。
OpenAI 发布 o3 和 o4-mini,称其为迄今最聪明、能力最强的模型,并具备完整工具访问能力。Feed 仅提供摘要,未包含更多功能、评测或开放细节。
推荐理由:原文虽为摘要,但交代了 o3 与 o4-mini 的定位和完整工具访问这一核心变化。
OpenAI o3 和 o4-mini System Card 称,两款模型结合了 state-of-the-art 推理与完整工具能力。材料列出的工具包括 web browsing、Python、图像和文件分析、图像生成、canvas、automations、file search 和 memory。
推荐理由:材料列出 o3 与 o4-mini 的推理和工具能力范围,便于了解官方对模型定位的表述。
OpenAI 在 API 中推出 GPT-4.1,这是一个新的模型家族,在编码、指令遵循和长上下文理解方面都有改进。OpenAI 同时发布其 nano 模型,今天起向全球开发者开放。
推荐理由:摘要点明了编码、指令遵循和长上下文三项改进,可用于判断 API 迁移关注点。
OpenAI 在 2025 launch 中为 GPT‑4o 引入原生图像生成,包括更强的文本渲染和指令跟随能力。原文还提到可探索 ChatGPT Images 2.5。
推荐理由:原文概括了 GPT‑4o 图像生成的能力重点,可作为了解文本渲染和指令跟随改进的入口。
OpenAI 在 API 中推出下一代音频模型,开发者可以指示文本转语音模型按特定方式说话。示例包括让模型“像有同理心的客服智能体一样说话”,用于提升语音智能体的定制能力。
推荐理由:原文给出文本转语音可控表达的新用法,适合关注语音智能体定制能力的开发者参考。
OpenAI 发布 GPT-4.5 研究预览版,称其为该公司迄今规模最大、知识最丰富的模型。
推荐理由:材料说明 GPT-4.5 以研究预览形式发布,可用于了解 OpenAI 对新模型的定位。
OpenAI o3-mini 系统卡概述了该模型的安全工作,涵盖安全评估、外部红队测试和 Preparedness Framework 评估。