Amazon Bedrock 在首尔和新加坡推出 Anthropic Claude 模型区域内推理
Amazon Bedrock 现支持 Anthropic Claude Opus 5 和 Claude Sonnet 5 在首尔、Claude Sonnet 5 在新加坡通过 bedrock-runtime endpoint 进行区域内推理。
Amazon Bedrock 现支持 Anthropic Claude Opus 5 和 Claude Sonnet 5 在首尔、Claude Sonnet 5 在新加坡通过 bedrock-runtime endpoint 进行区域内推理。
NVIDIA Isaac ROS 5.0 在 Toronto ROSCon 发布,面向 ROS 机器人开发加入新的 agentic 工作流和平台支持。
推荐理由:文章列出 agentic 工作流、ROS Lyrical 支持和 Jetson 部署路径,便于评估机器人开发链路变化。
NVIDIA 推出 NVIDIA DSX Ready,认证符合 DSX AI 工厂参考设计要求的合作伙伴电力与冷却产品。首批类别包括 BESS 和 CDU,合格方案来自 Hitachi Energy、LG Energy Solution、Tesla、LG Electronics、LiquidStack 和 Vertiv。
Hugging Face 介绍 tokenizers v1 release candidate,称其在 Apple M4 Max 单线程下对十个模型家族的编码速度较 v0.23 快 3 到 30 倍。
推荐理由:文章给出性能数据和实现拆解,可帮助判断 tokenizers v1 对训练与服务瓶颈的影响。
Pawprint Studio 的免费开放世界生物捕捉 RPG《Aniimo》本周首发登陆 GeForce NOW。玩家可在 Steam Deck、新支持的 Firefox 浏览器等设备串流,无需等待 45GB 下载。同周 007 First Light 获路径追踪更新并支持 DLSS 4.5,Active Matter、Outer Wilds 等共 11 款游戏加入云端。
IBM Research 在 ALTK-Evolve 中引入 Consistency Analyzer 和 consistency guidelines,用于衡量并降低 AI 智能体重复执行同一任务时的波动。
推荐理由:原文把平均准确率与重复成功率分开衡量,为排查智能体生产环境波动提供了可迁移方法。
TRL v1.14 的 AsyncGRPOTrainer 现在可训练 LoRA adapter,并只把该 adapter 同步到 vLLM。
推荐理由:文章把 LoRA 适配器同步、HF Jobs 编排和瓶颈定位串成可复现实验,便于迁移到异步 RL 训练。
GitHub 推出 Project HydraFusion 研究预览,在 GitHub Copilot CLI 中通过运行时多模型编排完成编码任务。HydraFusion 面向所有 GitHub Copilot 计划用户开放,可通过 /experimental 使用,并会在 Single、Cascade、Critique 三种执行模式中选择工作流。
推荐理由:原文披露了路由模式、使用入口和三项编码基准结果,可用于比较多模型编排的成本取舍。
Google DeepMind 推出 Fairwind Program,向政府、可信合作伙伴和部分 Google Cloud 客户开放先进网络防御能力。该计划将 Gemini 3.8 Flash Cyber 与 CodeMender harness 结合,用于自主发现、验证和修复漏洞,并称可在组织的安全云环境中数分钟生成经验证、可部署的补丁。
推荐理由:材料展示 Google 将 Gemini 网络安全模型与 CodeMender 组合给政府和企业的部署路径,便于观察 AI 防御能力的落地边界。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 中推出智能体视频理解功能,用于提升视频分析准确性并降低 token 用量和成本。
推荐理由:原文同时给出成本、token 与质量变化,以及 API 开启方式,便于评估长视频分析工作流。
Hugging Face 发布 @huggingface/kernels,一个用于从 Hugging Face Hub 加载并运行优化 WebGPU kernels 的最小库,同时推出 207 个 WebGPU kernels 和浏览器内 GPU 基准测试套件 Fleet。
推荐理由:文章给出内核打包、加载和基准结果,可帮助开发者评估浏览器本地推理的底层优化路径。
Gradio 的 gr.Workflow 将 AI 应用管线描述为类型化节点图,并提供拖拽画布,让每个节点可运行、中间结果可见。同一图也会成为 REST API,并可一条命令部署到 Hugging Face Spaces。
推荐理由:原文展示了 gr.Workflow 如何把多步 AI 管线做成可运行画布和 REST API,便于复用到 Gradio 应用。
OlmoEarth Studio 现在支持计算并导出由开源 OlmoEarth 基础模型生成的地球观测嵌入向量,用于下游分析。
Microsoft Research 推出 Orchard,一个用于可扩展、低成本 Agentic AI 研究的开源框架,核心是可复用的 Kubernetes 环境服务 Orchard Env。
推荐理由:原文把环境层、训练配方和评测结果放在一起,便于理解开源 Agent 研究中工程成本与复用方式的变化。
Hugging Face 在 Diffusers 中加入 Nunchaku Lite 支持,预量化 Nunchaku checkpoint 可用 from_pretrained() 直接加载,无需自定义 pipeline、单独推理引擎或本地 CUDA 编译。
推荐理由:原文同时给出加载方式、硬件支持和基准数据,便于评估4-bit扩散推理在现有Diffusers流程中的接入成本。
Grabette 发布为一个开源、低成本的手持夹爪系统,用于在没有机器人、实验室或遥操作装置的情况下记录机器人操作数据。它包含 Grabette 手持示教设备和 Gripette 机器人夹爪,BOM 成本分别约为 490€ 和 120€,并通过浏览器处理流程把采集片段上传到 HF Hub、运行 SLAM、转换为 LeRobot 数据集。
推荐理由:原文把硬件、采集流程和 LeRobot 数据格式串起来,展示低成本采集机器人操作数据的路径。
Google DeepMind 在印度启动 ATL Saathi 现场试点,这是一款 Gemini 驱动的 Web 应用,为 Tinkering Lab 教师提供 24/7 规划与培训助手。它整合 NotebookLM 内容,覆盖 12 个核心模块、10 个模块的项目生成,并支持首批 8 种语言;试点将先面向全国 100 所学校。
Mistral AI 在 Studio 中为 Prompts 和 Skills 提供集中记录系统,让每个资产具备版本、所有者和可追溯记录。Studio 支持不可变版本、回滚、分类标签和审计日志,并可通过 Observability 将生产输出追溯到对应资产版本。
Google DeepMind 将 computer use 作为内置工具加入 Gemini 3.5 Flash,用于构建可跨浏览器、移动和桌面环境交互的智能体。
推荐理由:原文说明了能力入口和安全措施,可帮助开发者评估跨浏览器、移动和桌面自动化的接入方式。
Mistral AI 为 Connectors 引入多项新能力,用于更安全地连接外部企业平台并治理 AI 智能体访问。
推荐理由:原文展示了企业连接器从权限、身份到故障排查的治理设计,可参考其生产化接入思路。
Google DeepMind 与英国政府共建 Gemini 驱动的 AI 规划原型,目标将房主规划申请处理时间缩短 50%。工具可整合数据、识别政策、总结反馈并起草评估,规划官保留最终审批权,政府计划 2027 年起向全国议会开放。
Mistral 在 AI Now Summit 2026 公布面向企业和政府的 full-stack AI 方案,包括 Mistral for Industrial Engineering、Vibe 更新和 Les Ulis data center。
Mistral 将 Le Chat 更名并升级为 Vibe,定位为覆盖工作和编码的统一 AI 智能体,原有对话、设置和套餐会迁移。Work Mode 面向企业工具中的多步骤任务,支持知识搜索、数据分析、文档合成、定时任务和可复用技能;Code Mode 可在网页中连接 GitHub、管理项目、启动远程编码会话并推进到 pull request。
推荐理由:原文同时列出工作与编码两条模式,能帮助判断 Vibe 对企业流程和开发协作的覆盖范围。
Mistral AI 发布 Search Toolkit 公共预览版,这是一个用于为 AI 应用构建生产级搜索管线的可组合框架。
推荐理由:原文把摄取、检索和评估放进同一框架,可作为企业 RAG 检索管线的工程取舍参考。
Mistral 将 Emmi AI 纳入旗下,建设面向工业工程的 physics AI 基础能力。physics AI 从物理求解器输出学习,可由几何、边界条件或测量数据预测物理场,在单个 GPU 上以秒级完成推理,用于加速产品设计、工装与工艺设计及实时数字孪生。
Mistral AI 在 Studio 发布 Connectors,内置连接器和自定义 MCP 现可通过 API/SDK 用于所有模型和 Agent 调用。新功能包括直接 tool calling、人工审批流程,以及通过程序创建、修改、列出和删除连接器,并可列出或直接运行其工具。
推荐理由:原文展示了连接器注册、直接调用和人工审批流程,可借鉴其企业智能体集成方式。
Google DeepMind 正在为 Project Genie 推出由 Street View 支持的真实地点锚定能力,并向全球符合条件的 Google AI Ultra $200 订阅用户逐步开放。
推荐理由:原文说明 Project Genie 如何用 Street View 锚定真实地点,可作为观察世界模型产品化路径的案例。
Google DeepMind 推出 Gemini for Science,包含 Google Antigravity 中的新 Science Skills,以及 Google Labs 上的 3 个科研实验工具。
推荐理由:原文集中列出实验工具、Science Skills 与企业预览案例,便于了解 Google 科研智能体布局。
Google 正在扩展 Search、Gemini、Chrome、Pixel 和 Cloud 中的内容透明度与验证工具,并推出 AI Content Detection API。
推荐理由:原文梳理了 SynthID、C2PA 与检测 API 的扩展路径,可用于理解内容溯源工具的落地方式。
剑桥大学 Clare Bryant 正用 Google DeepMind Co-Scientist 寻找病原体跨物种传播后导致重症的分子开关。该工具从候选蛋白细化到具体氨基酸,团队正构建含氨基酸突变的细胞系;若目标正确,原本需 2-3 年的实验有望在 6 个月完成。
Calico Life Sciences 用 Co-Scientist 连接衰老生物学文献并生成可检验假设。在 ISR 项目中,团队让 Co-Scientist 提出代谢调控 ISR 的假设,并共同细化实验设计。实验产生了关于 ISR 在健康和疾病中作用的新发现,团队计划发表结果。
Co-Scientist 帮助 MIT 的 Ritu Raman 快速梳理 ALS 文献,形成可测试假设并按可行性与风险回报排序。她随后与 Boston Children's Hospital 的 Ryan Flynn 迭代使用 Co-Scientist,结合组织模型和细胞表面 RNA 映射,寻找可靶向 ALS 的新 RNA 机制及潜在 RNA 药物。
Mistral AI 发布 Workflows 公共预览版,作为企业 AI 的编排层,用于把 AI 驱动流程从概念验证可靠移入生产。Workflows 属于 Studio,开发者用 Python 编写流程,可发布到 Le Chat 供组织内触发,并在 Studio 中跟踪和审计每一步。
推荐理由:原文展示了企业 AI 流程从编排到审计的落地路径,并给出货运、KYC 和客服分流场景。
Mistral AI 推出 Forge,帮助企业用专有知识训练面向内部流程的 AI 模型。Forge 支持预训练、后训练、强化学习、dense 与 MoE 架构,以及按需处理多模态输入。Mistral Vibe 等智能体可用它微调模型、寻找超参数、调度任务并生成合成数据。
Mistral 发布 Mistral Vibe 2.0,这是其终端原生编码智能体的一次重大升级,由 Devstral 2 模型家族驱动。新版支持自定义子智能体、多选澄清、slash-command 技能、统一 Agent 模式和自动更新,面向 Le Chat Pro 和 Team 计划开放,支持 PAYG 额外用量或 BYOK。
推荐理由:原文同时说明了新工作流控制、订阅入口和 Devstral 2 API 价格,便于评估团队接入成本。
Mistral AI 推出 Mistral AI Studio,面向企业团队提供将 AI 从原型推进到生产的 Production AI Platform。平台由 Observability、Agent Runtime 和 AI Registry 三大支柱组成,支持评估、反馈闭环、版本追踪、治理与可复现执行。
OpenAI 推出可在 ChatGPT 内直接对话的新一代应用,并发布新的 Apps SDK。开发者可以从今天开始使用处于 preview 状态的 Apps SDK 构建这些应用。
推荐理由:原文同时给出 ChatGPT 内应用形态和 Apps SDK 预览状态,便于开发者判断接入时机。
OpenAI 发布 AgentKit、扩展的 evals 能力和面向智能体的 reinforcement fine-tuning,帮助开发者更快从原型走向生产。
推荐理由:原文概括了 AgentKit、evals 扩展和智能体 RFT,可用于了解 OpenAI 面向开发者的工具组合变化。
Wrtn 借助 GPT-5 将 AI 应用扩展至韩国 6.5M 用户,打造融合生产力、创意与学习的“Lifestyle AI”。该产品现正向东亚其他市场扩张。
OpenAI 构建了内部 AI 销售助手,用于自动化账户研究、会议准备、产品知识和客户跟进,以提升销售效率与客户成功。