Amazon Bedrock 在首尔和新加坡推出 Anthropic Claude 模型区域内推理
Amazon Bedrock 现支持 Anthropic Claude Opus 5 和 Claude Sonnet 5 在首尔、Claude Sonnet 5 在新加坡通过 bedrock-runtime endpoint 进行区域内推理。
Amazon Bedrock 现支持 Anthropic Claude Opus 5 和 Claude Sonnet 5 在首尔、Claude Sonnet 5 在新加坡通过 bedrock-runtime endpoint 进行区域内推理。
Bluesky reply bot checker 可分析 Bluesky 账号近期帖子,检测自动回复机器人常见行为模式。它检查打字速度、发帖时间、互动模式等信号,并展示每项测量、规则和触发信号的示例回复。作者称该工具由 Opus 5.5 vibe code 编写,利用 Bluesky 仍可免费使用的 API 调查疑似回复机器人。
Simon Willison 制作了 Gemini 3.8 TTS Playground,用于通过交互式界面测试 Google 的 Gemini 3.8 text-to-speech API。
NVIDIA Isaac ROS 5.0 在 Toronto ROSCon 发布,面向 ROS 机器人开发加入新的 agentic 工作流和平台支持。
推荐理由:文章列出 agentic 工作流、ROS Lyrical 支持和 Jetson 部署路径,便于评估机器人开发链路变化。
NVIDIA 推出 NVIDIA DSX Ready,认证符合 DSX AI 工厂参考设计要求的合作伙伴电力与冷却产品。首批类别包括 BESS 和 CDU,合格方案来自 Hitachi Energy、LG Energy Solution、Tesla、LG Electronics、LiquidStack 和 Vertiv。
Hugging Face 介绍 tokenizers v1 release candidate,称其在 Apple M4 Max 单线程下对十个模型家族的编码速度较 v0.23 快 3 到 30 倍。
推荐理由:文章给出性能数据和实现拆解,可帮助判断 tokenizers v1 对训练与服务瓶颈的影响。
Pawprint Studio 的免费开放世界生物捕捉 RPG《Aniimo》本周首发登陆 GeForce NOW。玩家可在 Steam Deck、新支持的 Firefox 浏览器等设备串流,无需等待 45GB 下载。同周 007 First Light 获路径追踪更新并支持 DLSS 4.5,Active Matter、Outer Wilds 等共 11 款游戏加入云端。
GitHub 推出 Project HydraFusion 研究预览,在 GitHub Copilot CLI 中通过运行时多模型编排完成编码任务。HydraFusion 面向所有 GitHub Copilot 计划用户开放,可通过 /experimental 使用,并会在 Single、Cascade、Critique 三种执行模式中选择工作流。
推荐理由:原文披露了路由模式、使用入口和三项编码基准结果,可用于比较多模型编排的成本取舍。
Google DeepMind 推出 Fairwind Program,向政府、可信合作伙伴和部分 Google Cloud 客户开放先进网络防御能力。该计划将 Gemini 3.8 Flash Cyber 与 CodeMender harness 结合,用于自主发现、验证和修复漏洞,并称可在组织的安全云环境中数分钟生成经验证、可部署的补丁。
推荐理由:材料展示 Google 将 Gemini 网络安全模型与 CodeMender 组合给政府和企业的部署路径,便于观察 AI 防御能力的落地边界。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 中推出智能体视频理解功能,用于提升视频分析准确性并降低 token 用量和成本。
推荐理由:原文同时给出成本、token 与质量变化,以及 API 开启方式,便于评估长视频分析工作流。
Hugging Face 发布 @huggingface/kernels,一个用于从 Hugging Face Hub 加载并运行优化 WebGPU kernels 的最小库,同时推出 207 个 WebGPU kernels 和浏览器内 GPU 基准测试套件 Fleet。
推荐理由:文章给出内核打包、加载和基准结果,可帮助开发者评估浏览器本地推理的底层优化路径。
Gradio 的 gr.Workflow 将 AI 应用管线描述为类型化节点图,并提供拖拽画布,让每个节点可运行、中间结果可见。同一图也会成为 REST API,并可一条命令部署到 Hugging Face Spaces。
推荐理由:原文展示了 gr.Workflow 如何把多步 AI 管线做成可运行画布和 REST API,便于复用到 Gradio 应用。
OlmoEarth Studio 现在支持计算并导出由开源 OlmoEarth 基础模型生成的地球观测嵌入向量,用于下游分析。
Microsoft Research 推出 Orchard,一个用于可扩展、低成本 Agentic AI 研究的开源框架,核心是可复用的 Kubernetes 环境服务 Orchard Env。
推荐理由:原文把环境层、训练配方和评测结果放在一起,便于理解开源 Agent 研究中工程成本与复用方式的变化。
Hugging Face 在 Diffusers 中加入 Nunchaku Lite 支持,预量化 Nunchaku checkpoint 可用 from_pretrained() 直接加载,无需自定义 pipeline、单独推理引擎或本地 CUDA 编译。
推荐理由:原文同时给出加载方式、硬件支持和基准数据,便于评估4-bit扩散推理在现有Diffusers流程中的接入成本。
Grabette 发布为一个开源、低成本的手持夹爪系统,用于在没有机器人、实验室或遥操作装置的情况下记录机器人操作数据。它包含 Grabette 手持示教设备和 Gripette 机器人夹爪,BOM 成本分别约为 490€ 和 120€,并通过浏览器处理流程把采集片段上传到 HF Hub、运行 SLAM、转换为 LeRobot 数据集。
推荐理由:原文把硬件、采集流程和 LeRobot 数据格式串起来,展示低成本采集机器人操作数据的路径。
Google DeepMind 在印度启动 ATL Saathi 现场试点,这是一款 Gemini 驱动的 Web 应用,为 Tinkering Lab 教师提供 24/7 规划与培训助手。它整合 NotebookLM 内容,覆盖 12 个核心模块、10 个模块的项目生成,并支持首批 8 种语言;试点将先面向全国 100 所学校。
Mistral AI 在 Studio 中为 Prompts 和 Skills 提供集中记录系统,让每个资产具备版本、所有者和可追溯记录。Studio 支持不可变版本、回滚、分类标签和审计日志,并可通过 Observability 将生产输出追溯到对应资产版本。
Google DeepMind 将 computer use 作为内置工具加入 Gemini 3.5 Flash,用于构建可跨浏览器、移动和桌面环境交互的智能体。
推荐理由:原文说明了能力入口和安全措施,可帮助开发者评估跨浏览器、移动和桌面自动化的接入方式。
Mistral AI 为 Connectors 引入多项新能力,用于更安全地连接外部企业平台并治理 AI 智能体访问。
推荐理由:原文展示了企业连接器从权限、身份到故障排查的治理设计,可参考其生产化接入思路。
Google DeepMind 与英国政府共建 Gemini 驱动的 AI 规划原型,目标将房主规划申请处理时间缩短 50%。工具可整合数据、识别政策、总结反馈并起草评估,规划官保留最终审批权,政府计划 2027 年起向全国议会开放。
Mistral 在 AI Now Summit 2026 公布面向企业和政府的 full-stack AI 方案,包括 Mistral for Industrial Engineering、Vibe 更新和 Les Ulis data center。
Mistral 将 Le Chat 更名并升级为 Vibe,定位为覆盖工作和编码的统一 AI 智能体,原有对话、设置和套餐会迁移。Work Mode 面向企业工具中的多步骤任务,支持知识搜索、数据分析、文档合成、定时任务和可复用技能;Code Mode 可在网页中连接 GitHub、管理项目、启动远程编码会话并推进到 pull request。
推荐理由:原文同时列出工作与编码两条模式,能帮助判断 Vibe 对企业流程和开发协作的覆盖范围。
Mistral AI 发布 Search Toolkit 公共预览版,这是一个用于为 AI 应用构建生产级搜索管线的可组合框架。
推荐理由:原文把摄取、检索和评估放进同一框架,可作为企业 RAG 检索管线的工程取舍参考。
Mistral 将 Emmi AI 纳入旗下,建设面向工业工程的 physics AI 基础能力。physics AI 从物理求解器输出学习,可由几何、边界条件或测量数据预测物理场,在单个 GPU 上以秒级完成推理,用于加速产品设计、工装与工艺设计及实时数字孪生。
Mistral AI 在 Studio 发布 Connectors,内置连接器和自定义 MCP 现可通过 API/SDK 用于所有模型和 Agent 调用。新功能包括直接 tool calling、人工审批流程,以及通过程序创建、修改、列出和删除连接器,并可列出或直接运行其工具。
推荐理由:原文展示了连接器注册、直接调用和人工审批流程,可借鉴其企业智能体集成方式。
Google DeepMind 称,生物学家 Omar Abudayyeh 和 Jonathan Gootenberg 正在用 Co-Scientist 加速寻找可能逆转细胞衰老的遗传线索。
推荐理由:案例展示了 Co-Scientist 在遗传衰老研究中连接文献、假设和筛选数据的具体流程。
Google DeepMind 正在为 Project Genie 推出由 Street View 支持的真实地点锚定能力,并向全球符合条件的 Google AI Ultra $200 订阅用户逐步开放。
推荐理由:原文说明 Project Genie 如何用 Street View 锚定真实地点,可作为观察世界模型产品化路径的案例。
Google DeepMind 推出 Gemini for Science,包含 Google Antigravity 中的新 Science Skills,以及 Google Labs 上的 3 个科研实验工具。
推荐理由:原文集中列出实验工具、Science Skills 与企业预览案例,便于了解 Google 科研智能体布局。
Google 正在扩展 Search、Gemini、Chrome、Pixel 和 Cloud 中的内容透明度与验证工具,并推出 AI Content Detection API。
推荐理由:原文梳理了 SynthID、C2PA 与检测 API 的扩展路径,可用于理解内容溯源工具的落地方式。
剑桥大学 Clare Bryant 正用 Google DeepMind Co-Scientist 寻找病原体跨物种传播后导致重症的分子开关。该工具从候选蛋白细化到具体氨基酸,团队正构建含氨基酸突变的细胞系;若目标正确,原本需 2-3 年的实验有望在 6 个月完成。
Calico Life Sciences 用 Co-Scientist 连接衰老生物学文献并生成可检验假设。在 ISR 项目中,团队让 Co-Scientist 提出代谢调控 ISR 的假设,并共同细化实验设计。实验产生了关于 ISR 在健康和疾病中作用的新发现,团队计划发表结果。
Co-Scientist 帮助 MIT 的 Ritu Raman 快速梳理 ALS 文献,形成可测试假设并按可行性与风险回报排序。她随后与 Boston Children's Hospital 的 Ryan Flynn 迭代使用 Co-Scientist,结合组织模型和细胞表面 RNA 映射,寻找可靶向 ALS 的新 RNA 机制及潜在 RNA 药物。
Mistral AI 发布 Workflows 公共预览版,作为企业 AI 的编排层,用于把 AI 驱动流程从概念验证可靠移入生产。Workflows 属于 Studio,开发者用 Python 编写流程,可发布到 Le Chat 供组织内触发,并在 Studio 中跟踪和审计每一步。
推荐理由:原文展示了企业 AI 流程从编排到审计的落地路径,并给出货运、KYC 和客服分流场景。
Mistral AI 推出 Forge,帮助企业用专有知识训练面向内部流程的 AI 模型。Forge 支持预训练、后训练、强化学习、dense 与 MoE 架构,以及按需处理多模态输入。Mistral Vibe 等智能体可用它微调模型、寻找超参数、调度任务并生成合成数据。
Mistral 发布 Mistral Vibe 2.0,这是其终端原生编码智能体的一次重大升级,由 Devstral 2 模型家族驱动。新版支持自定义子智能体、多选澄清、slash-command 技能、统一 Agent 模式和自动更新,面向 Le Chat Pro 和 Team 计划开放,支持 PAYG 额外用量或 BYOK。
推荐理由:原文同时说明了新工作流控制、订阅入口和 Devstral 2 API 价格,便于评估团队接入成本。
Mistral AI 推出 Mistral AI Studio,面向企业团队提供将 AI 从原型推进到生产的 Production AI Platform。平台由 Observability、Agent Runtime 和 AI Registry 三大支柱组成,支持评估、反馈闭环、版本追踪、治理与可复现执行。