跳到正文
10月2日 · 周五

最新精选

9月22日周二
9月21日周一
9月5日周六
  1. GitHub Blog · AI & ML76

    GitHub 推出 Project HydraFusion 研究预览,通过多模型编排服务 Copilot 编码任务

    GitHub 推出 Project HydraFusion 研究预览,在 GitHub Copilot CLI 中通过运行时多模型编排完成编码任务。HydraFusion 面向所有 GitHub Copilot 计划用户开放,可通过 /experimental 使用,并会在 Single、Cascade、Critique 三种执行模式中选择工作流。

    推荐理由:原文披露了路由模式、使用入口和三项编码基准结果,可用于比较多模型编排的成本取舍。

9月3日周四
  1. Google DeepMind60

    Google DeepMind 推出 Fairwind Program,向政府和企业开放 AI 网络防御能力

    Google DeepMind 推出 Fairwind Program,向政府、可信合作伙伴和部分 Google Cloud 客户开放先进网络防御能力。该计划将 Gemini 3.8 Flash Cyber 与 CodeMender harness 结合,用于自主发现、验证和修复漏洞,并称可在组织的安全云环境中数分钟生成经验证、可部署的补丁。

    推荐理由:材料展示 Google 将 Gemini 网络安全模型与 CodeMender 组合给政府和企业的部署路径,便于观察 AI 防御能力的落地边界。

9月2日周三
  1. Google DeepMind81

    Google DeepMind 在 Gemini 中推出智能体视频理解功能

    Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 中推出智能体视频理解功能,用于提升视频分析准确性并降低 token 用量和成本。

    推荐理由:原文同时给出成本、token 与质量变化,以及 API 开启方式,便于评估长视频分析工作流。

9月1日周二
  1. Hugging Face Blog70

    Hugging Face 发布 @huggingface/kernels 和 207 个 WebGPU Kernels

    Hugging Face 发布 @huggingface/kernels,一个用于从 Hugging Face Hub 加载并运行优化 WebGPU kernels 的最小库,同时推出 207 个 WebGPU kernels 和浏览器内 GPU 基准测试套件 Fleet。

    推荐理由:文章给出内核打包、加载和基准结果,可帮助开发者评估浏览器本地推理的底层优化路径。

8月25日周二
  1. Hugging Face Blog79

    Gradio gr.Workflow 支持用画布构建、运行和部署 AI 工作流

    Gradio 的 gr.Workflow 将 AI 应用管线描述为类型化节点图,并提供拖拽画布,让每个节点可运行、中间结果可见。同一图也会成为 REST API,并可一条命令部署到 Hugging Face Spaces。

    推荐理由:原文展示了 gr.Workflow 如何把多步 AI 管线做成可运行画布和 REST API,便于复用到 Gradio 应用。

8月4日周二
  1. Microsoft Research74

    Microsoft Research 发布开源 Agent 框架 Orchard

    Microsoft Research 推出 Orchard,一个用于可扩展、低成本 Agentic AI 研究的开源框架,核心是可复用的 Kubernetes 环境服务 Orchard Env。

    推荐理由:原文把环境层、训练配方和评测结果放在一起,便于理解开源 Agent 研究中工程成本与复用方式的变化。

7月23日周四
  1. Hugging Face Blog69

    Hugging Face Diffusers 原生支持 Nunchaku 4-bit 扩散推理

    Hugging Face 在 Diffusers 中加入 Nunchaku Lite 支持,预量化 Nunchaku checkpoint 可用 from_pretrained() 直接加载,无需自定义 pipeline、单独推理引擎或本地 CUDA 编译。

    推荐理由:原文同时给出加载方式、硬件支持和基准数据,便于评估4-bit扩散推理在现有Diffusers流程中的接入成本。

7月21日周二
  1. Hugging Face Blog61

    Grabette 开源低成本机器人操作数据采集系统发布

    Grabette 发布为一个开源、低成本的手持夹爪系统,用于在没有机器人、实验室或遥操作装置的情况下记录机器人操作数据。它包含 Grabette 手持示教设备和 Gripette 机器人夹爪,BOM 成本分别约为 490€ 和 120€,并通过浏览器处理流程把采集片段上传到 HF Hub、运行 SLAM、转换为 LeRobot 数据集。

    推荐理由:原文把硬件、采集流程和 LeRobot 数据格式串起来,展示低成本采集机器人操作数据的路径。

6月25日周四
  1. Google DeepMind77

    Google DeepMind 将 computer use 内置到 Gemini 3.5 Flash

    Google DeepMind 将 computer use 作为内置工具加入 Gemini 3.5 Flash,用于构建可跨浏览器、移动和桌面环境交互的智能体。

    推荐理由:原文说明了能力入口和安全措施,可帮助开发者评估跨浏览器、移动和桌面自动化的接入方式。

6月24日周三
5月28日周四
  1. Mistral AI81

    Mistral 将 Le Chat 升级为 Vibe 统一 AI 智能体

    Mistral 将 Le Chat 更名并升级为 Vibe,定位为覆盖工作和编码的统一 AI 智能体,原有对话、设置和套餐会迁移。Work Mode 面向企业工具中的多步骤任务,支持知识搜索、数据分析、文档合成、定时任务和可复用技能;Code Mode 可在网页中连接 GitHub、管理项目、启动远程编码会话并推进到 pull request。

    推荐理由:原文同时列出工作与编码两条模式,能帮助判断 Vibe 对企业流程和开发协作的覆盖范围。

5月22日周五
  1. Mistral AI74

    Mistral AI 在 Studio 发布 Connectors,支持内置连接器和自定义 MCP

    Mistral AI 在 Studio 发布 Connectors,内置连接器和自定义 MCP 现可通过 API/SDK 用于所有模型和 Agent 调用。新功能包括直接 tool calling、人工审批流程,以及通过程序创建、修改、列出和删除连接器,并可列出或直接运行其工具。

    推荐理由:原文展示了连接器注册、直接调用和人工审批流程,可借鉴其企业智能体集成方式。

5月19日周二
5月18日周一
  1. Google DeepMind66

    Google DeepMind 为 Project Genie 推出 Street View 真实地点生成能力

    Google DeepMind 正在为 Project Genie 推出由 Street View 支持的真实地点锚定能力,并向全球符合条件的 Google AI Ultra $200 订阅用户逐步开放。

    推荐理由:原文说明 Project Genie 如何用 Street View 锚定真实地点,可作为观察世界模型产品化路径的案例。

5月17日周日
  1. Google DeepMind64

    Google DeepMind 推出 Gemini for Science 科研工具与 Science Skills

    Google DeepMind 推出 Gemini for Science,包含 Google Antigravity 中的新 Science Skills,以及 Google Labs 上的 3 个科研实验工具。

    推荐理由:原文集中列出实验工具、Science Skills 与企业预览案例,便于了解 Google 科研智能体布局。

4月27日周一
  1. Mistral AI71

    Mistral AI 发布 Workflows 公共预览版,面向企业 AI 编排

    Mistral AI 发布 Workflows 公共预览版,作为企业 AI 的编排层,用于把 AI 驱动流程从概念验证可靠移入生产。Workflows 属于 Studio,开发者用 Python 编写流程,可发布到 Le Chat 供组织内触发,并在 Studio 中跟踪和审计每一步。

    推荐理由:原文展示了企业 AI 流程从编排到审计的落地路径,并给出货运、KYC 和客服分流场景。