跳到正文

全部动态

今日 2 条
今天10月2日周五
  1. AWS Machine Learning Blog74

    在 Amazon Bedrock AgentCore Runtime Instances 上构建多智能体音乐制作流水线

    AWS Machine Learning Blog 演示在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线,三个智能体在同一 GPU 实例和共享会话中生成、交付并筛查 .wav 曲目。

    推荐理由:文章把共享会话、GPU 实例和持久卷串成完整样例,便于迁移到长任务多智能体流水线设计。

9月30日周三
  1. AWS Machine Learning Blog45

    Amazon Quick 提示词工程基础

    Amazon Quick 的提示词工程通过更具体的需求、业务上下文和示例,提升其 AI 功能对自然语言请求的准确性和可靠性。这是两部分系列的 Part 1,聚焦适用于各 Quick 组件的通用原则和可复用框架,包括 CRISPE。Part 2 将讨论 Research、Flows、Sight、Chat Agents 和 Action Integrations 的组件特定技巧。

9月29日周二
9月23日周三
9月22日周二
9月21日周一
  1. NVIDIA Blog53

    NVIDIA 解析 AI 安全在 Agent stack 各层的工程做法

    NVIDIA 认为 AI 安全是工程问题,需要明确安全要求、可执行控制、责任 owner,并提供保护措施有效的证据。文章将 Agent stack 分为模型、harness 和运行时环境,强调每层都要有安全责任,运行环境应在文件、网络目标和进程上设置独立于 agent 推理的边界。

9月17日周四
9月16日周三
9月10日周四
9月5日周六
  1. GitHub Blog · AI & ML76

    GitHub 推出 Project HydraFusion 研究预览,通过多模型编排服务 Copilot 编码任务

    GitHub 推出 Project HydraFusion 研究预览,在 GitHub Copilot CLI 中通过运行时多模型编排完成编码任务。HydraFusion 面向所有 GitHub Copilot 计划用户开放,可通过 /experimental 使用,并会在 Single、Cascade、Critique 三种执行模式中选择工作流。

    推荐理由:原文披露了路由模式、使用入口和三项编码基准结果,可用于比较多模型编排的成本取舍。

9月4日周五
  1. GitHub Blog · AI & ML57

    GitHub Copilot app 入门:同时运行多个智能体

    GitHub Copilot app 可以在同一项目中同时运行多个独立的智能体会话,并通过 sessions view 管理进度。每个会话可运行在自己的 Git worktree 中,保留各自上下文,切换时不需要重新解释任务。文章用 tailspin-toys 示例演示同时添加 funded sort、做 accessibility review 和运行测试,并建议先尝试并行启动两个小任务。

9月3日周四
  1. Hugging Face Blog72

    用 TRL 和 OpenEnv 训练编码模型绘制水彩画

    作者用 TRL 和 OpenEnv 复现了让编码模型写 JavaScript 绘制水彩画的训练流程,并公开了参考池数据集、RL 环境、训练脚本和训练模型。流程让模型通过 p5.brush 生成约 150 行 JavaScript,用 gate、长度、pairwise judge 和 HPSv3 组成奖励,其中参考池包含 178 幅由作者手工评级的模型生成画作。

    推荐理由:文章把审美奖励训练拆成数据池、环境、评审模型和成本,适合作为复现同类实验的工程参考。

  2. Google DeepMind60

    Google DeepMind 推出 Fairwind Program,向政府和企业开放 AI 网络防御能力

    Google DeepMind 推出 Fairwind Program,向政府、可信合作伙伴和部分 Google Cloud 客户开放先进网络防御能力。该计划将 Gemini 3.8 Flash Cyber 与 CodeMender harness 结合,用于自主发现、验证和修复漏洞,并称可在组织的安全云环境中数分钟生成经验证、可部署的补丁。

    推荐理由:材料展示 Google 将 Gemini 网络安全模型与 CodeMender 组合给政府和企业的部署路径,便于观察 AI 防御能力的落地边界。

9月2日周三
9月1日周二
8月28日周五
8月26日周三
8月25日周二
  1. Hugging Face Blog79

    Gradio gr.Workflow 支持用画布构建、运行和部署 AI 工作流

    Gradio 的 gr.Workflow 将 AI 应用管线描述为类型化节点图,并提供拖拽画布,让每个节点可运行、中间结果可见。同一图也会成为 REST API,并可一条命令部署到 Hugging Face Spaces。

    推荐理由:原文展示了 gr.Workflow 如何把多步 AI 管线做成可运行画布和 REST API,便于复用到 Gradio 应用。

8月21日周五
  1. Google DeepMind55

    Google DeepMind 回顾 15 年游戏 AI 研究,并介绍与 Fenris Creations 的 EVE 合作

    Google DeepMind 回顾了从 Atari 到 EVE Online 的 15 年游戏 AI 研究,并介绍其与游戏开发者合作原型化新玩法体验的方向。文章梳理了 DQN、AlphaGo、AlphaZero、MuZero、AlphaStar 和 AlphaFold 的关联,并称 SIMA 2 由 Gemini 驱动,可在屏幕观察、自然语言指令和键鼠控制下作为交互式伴侣。

  2. Hugging Face Blog69

    Hugging Face 研究如何衡量语音识别中的基准优化

    Hugging Face 的最新研究提出三项测试,用于量化语音识别中的 benchmark optimization 或 benchmaxxing 现象。研究评估了 11 个常用开源 ASR 模型,发现部分高分系统会复现 VoxPopuli English 和 LibriSpeech 的基准转写,即使音频与参考文本矛盾、相关词被静音,或同一音频支持不同书写形式。

    推荐理由:文章用三类探针展示公开语音基准的过拟合迹象,可帮助评估者区分榜单分数与真实转写能力。

8月14日周五
  1. Hugging Face Blog76

    Hugging Face 发布开放模型现状夏季报告:2026 年 1 至 8 月观察

    Hugging Face 的开放模型现状夏季报告分析了 2026 年 1 月至 8 月的 Hub 数据,公共模型仓库从 2.43 million 增至 2.96 million,数据集从 711,000 增至 1 million,Spaces 从 1.00 million 增至 1.44 million。

    推荐理由:报告用 Hub 下载、点赞和衍生仓库数据,展示开放模型生态在规模、采用与运行层的分化。