AMD 与 OpenAI 宣布战略合作,部署 6 gigawatts AMD GPUs
AMD 与 OpenAI 宣布一项多年期合作,将部署 6 gigawatts 的 AMD Instinct GPUs,用于支持 OpenAI 下一代 AI 基础设施。部署将从 2026 年的 1 gigawatt 开始,目标是加速全球 AI 创新。
推荐理由:原文给出部署规模和起始时间,可用于观察 OpenAI 下一代 AI 基础设施的算力布局。
把模型跑起来的工程实践:推理优化、显存与成本、Serving 架构与基础设施选型。
AMD 与 OpenAI 宣布一项多年期合作,将部署 6 gigawatts 的 AMD Instinct GPUs,用于支持 OpenAI 下一代 AI 基础设施。部署将从 2026 年的 1 gigawatt 开始,目标是加速全球 AI 创新。
推荐理由:原文给出部署规模和起始时间,可用于观察 OpenAI 下一代 AI 基础设施的算力布局。
Samsung 和 SK 加入 OpenAI 的 Stargate 计划,目标是扩大全球 AI 基础设施。该合作将扩大先进存储芯片生产,并在韩国建设下一代数据中心。
推荐理由:原文说明了 OpenAI 与韩国芯片和数据中心伙伴的合作方向,可作为观察 AI 基础设施扩张的背景。
OpenAI 与 NVIDIA 宣布战略合作,将部署由 NVIDIA 系统驱动的 10 gigawatts AI 数据中心。第一阶段计划于 2026 年启动。
推荐理由:原文给出合作规模和首阶段时间,可作为观察大模型基础设施扩张节奏的背景。
GPT-5 System Card 解释了统一模型路由系统如何通过 gpt-5-main、gpt-5-thinking 和 gpt-5-thinking-nano 等轻量版本提供快速且智能的响应。不同版本针对不同任务和开发者用途优化。
推荐理由:材料概述了 GPT-5 的模型路由组成和轻量版本定位,便于理解不同任务下的响应分工。
OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b,两款开放权重语言模型采用 Apache 2.0 license。它们强调低成本的现实表现,在推理任务上优于同等规模开放模型,具备较强工具使用能力,并针对消费级硬件高效部署优化。
推荐理由:原文同时给出开源许可、低成本部署和推理表现,便于比较开放权重模型取向。
Oracle 与 OpenAI 达成协议,将在美国开发额外 4.5 gigawatts 的 Stargate 数据中心容量。OpenAI 称这项投资将创造新就业、加速美国再工业化,并推进美国 AI 领导地位;这也是 Stargate 这一 OpenAI AI 基础设施平台的重要里程碑。
推荐理由:原文提供了 Stargate 在美国扩充数据中心容量的规模,可用于了解 OpenAI 基础设施布局。
OpenAI 推出 Stargate UAE,这是其 AI 基础设施平台 Stargate 的首个国际部署。材料仅提供摘要,未包含更多部署细节。
推荐理由:原文说明 Stargate 开始在美国以外部署,可作为观察 OpenAI 基础设施扩张的背景。