跳到正文

#编码

今日 0 条
9月29日周二
9月5日周六
  1. GitHub Blog · AI & ML76

    GitHub 推出 Project HydraFusion 研究预览,通过多模型编排服务 Copilot 编码任务

    GitHub 推出 Project HydraFusion 研究预览,在 GitHub Copilot CLI 中通过运行时多模型编排完成编码任务。HydraFusion 面向所有 GitHub Copilot 计划用户开放,可通过 /experimental 使用,并会在 Single、Cascade、Critique 三种执行模式中选择工作流。

    推荐理由:原文披露了路由模式、使用入口和三项编码基准结果,可用于比较多模型编排的成本取舍。

9月4日周五
  1. GitHub Blog · AI & ML57

    GitHub Copilot app 入门:同时运行多个智能体

    GitHub Copilot app 可以在同一项目中同时运行多个独立的智能体会话,并通过 sessions view 管理进度。每个会话可运行在自己的 Git worktree 中,保留各自上下文,切换时不需要重新解释任务。文章用 tailspin-toys 示例演示同时添加 funded sort、做 accessibility review 和运行测试,并建议先尝试并行启动两个小任务。

9月3日周四
  1. Hugging Face Blog72

    用 TRL 和 OpenEnv 训练编码模型绘制水彩画

    作者用 TRL 和 OpenEnv 复现了让编码模型写 JavaScript 绘制水彩画的训练流程,并公开了参考池数据集、RL 环境、训练脚本和训练模型。流程让模型通过 p5.brush 生成约 150 行 JavaScript,用 gate、长度、pairwise judge 和 HPSv3 组成奖励,其中参考池包含 178 幅由作者手工评级的模型生成画作。

    推荐理由:文章把审美奖励训练拆成数据池、环境、评审模型和成本,适合作为复现同类实验的工程参考。

  2. Google DeepMind60

    Google DeepMind 推出 Fairwind Program,向政府和企业开放 AI 网络防御能力

    Google DeepMind 推出 Fairwind Program,向政府、可信合作伙伴和部分 Google Cloud 客户开放先进网络防御能力。该计划将 Gemini 3.8 Flash Cyber 与 CodeMender harness 结合,用于自主发现、验证和修复漏洞,并称可在组织的安全云环境中数分钟生成经验证、可部署的补丁。

    推荐理由:材料展示 Google 将 Gemini 网络安全模型与 CodeMender 组合给政府和企业的部署路径,便于观察 AI 防御能力的落地边界。

8月25日周二
8月14日周五
8月10日周一
8月4日周二
  1. Microsoft Research74

    Microsoft Research 发布开源 Agent 框架 Orchard

    Microsoft Research 推出 Orchard,一个用于可扩展、低成本 Agentic AI 研究的开源框架,核心是可复用的 Kubernetes 环境服务 Orchard Env。

    推荐理由:原文把环境层、训练配方和评测结果放在一起,便于理解开源 Agent 研究中工程成本与复用方式的变化。

7月21日周二
7月17日周五
6月16日周二
5月28日周四
  1. Mistral AI81

    Mistral 将 Le Chat 升级为 Vibe 统一 AI 智能体

    Mistral 将 Le Chat 更名并升级为 Vibe,定位为覆盖工作和编码的统一 AI 智能体,原有对话、设置和套餐会迁移。Work Mode 面向企业工具中的多步骤任务,支持知识搜索、数据分析、文档合成、定时任务和可复用技能;Code Mode 可在网页中连接 GitHub、管理项目、启动远程编码会话并推进到 pull request。

    推荐理由:原文同时列出工作与编码两条模式,能帮助判断 Vibe 对企业流程和开发协作的覆盖范围。

3月17日周二
3月11日周三
1月28日周三
  1. Mistral AI74

    Mistral 发布 Mistral Vibe 2.0,升级终端原生编码智能体

    Mistral 发布 Mistral Vibe 2.0,这是其终端原生编码智能体的一次重大升级,由 Devstral 2 模型家族驱动。新版支持自定义子智能体、多选澄清、slash-command 技能、统一 Agent 模式和自动更新,面向 Le Chat Pro 和 Team 计划开放,支持 PAYG 额外用量或 BYOK。

    推荐理由:原文同时说明了新工作流控制、订阅入口和 Devstral 2 API 价格,便于评估团队接入成本。

12月9日周二
9月15日周一
  1. OpenAI News74

    OpenAI 发布 GPT-5-Codex 并补充 GPT-5 system card

    OpenAI 在 GPT-5 system card 附录中介绍新模型 GPT-5-Codex,这是一个为 Codex 中智能体编码进一步优化的 GPT-5 版本。GPT-5-Codex 会根据任务复杂度更动态地调整思考投入,对简单对话查询或小任务快速响应,对更复杂任务则独立工作更久。

    推荐理由:原文说明了 GPT-5-Codex 面向 Codex 中智能体编码的优化方向,可用于了解其任务复杂度适配思路。

8月7日周四
  1. OpenAI News84

    OpenAI 推出 GPT-5

    OpenAI 推出 GPT-5,称其为迄今最好的 AI 系统。OpenAI 表示,GPT-5 相比其以往所有模型在智能上有显著提升,在编码、数学、写作、健康、视觉感知等方面具备先进性能。

    推荐理由:原文列出 GPT-5 相比既有模型的覆盖领域,便于快速把握 OpenAI 对本代模型的定位。

7月17日周四
  1. OpenAI News71

    OpenAI 发布 ChatGPT agent System Card

    OpenAI 发布 ChatGPT agent System Card,称其智能体模型结合研究、浏览器自动化和代码工具,并在 Preparedness Framework 下配套防护措施。

    推荐理由:材料概括了 ChatGPT agent 的工具范围和安全框架,可作为理解其风险边界的入口。

5月22日周四
5月16日周五
  1. OpenAI News72

    OpenAI 发布 o3 和 o4-mini 系统卡的 Codex 补充说明

    OpenAI 发布 o3 和 o4-mini 系统卡的 Codex 补充说明,介绍 Codex 是云端编码智能体。Codex 由 codex-1 驱动,codex-1 是针对软件工程优化的 OpenAI o3 版本。codex-1 使用强化学习在多种环境中的真实编码任务上训练,可生成接近人类风格和 PR 偏好的代码,遵循指令,并迭代运行测试直到通过。

    推荐理由:材料交代了 Codex 与 codex-1 的关系,并说明训练如何面向真实软件工程任务与测试循环。

4月14日周一
  1. OpenAI News79

    OpenAI 在 API 中推出 GPT-4.1 模型家族

    OpenAI 在 API 中推出 GPT-4.1,这是一个新的模型家族,在编码、指令遵循和长上下文理解方面都有改进。OpenAI 同时发布其 nano 模型,今天起向全球开发者开放。

    推荐理由:摘要点明了编码、指令遵循和长上下文三项改进,可用于判断 API 迁移关注点。

3月6日周四
2月18日周二
8月25日周五