跳到正文

#模型发布

今日 0 条
9月29日周二
9月3日周四
8月28日周五
8月25日周二
8月21日周五
8月14日周五
8月12日周三
8月11日周二
8月10日周一
8月6日周四
8月4日周二
  1. Mistral AI67

    Mistral AI 发布 Shieldstral 3B 开放权重多模态安全分类器

    Mistral AI 发布 Shieldstral,一个 3B 开放权重、策略自适应的多模态安全分类器。它在推理时接受自然语言政策问题,将文本和图像安全评估统一为二元问答任务,无需重训,并输出校准后的安全分数。

    推荐理由:它把内容审核改写为可提问的安全判断,为需要按场景调整策略且不想重训的产品提供参考。

7月30日周四
7月28日周二
  1. Google DeepMind74

    Google DeepMind 发布 Gemini Robotics 2,面向机器人全身控制、灵巧操作与协作

    Google DeepMind 发布 Gemini Robotics 2,包括 Gemini Robotics 2、Gemini Robotics ER 2 和 Gemini Robotics On-Device 2 三个模型,面向机器人全身控制、双手或夹爪灵巧操作和多机器人协作。

    推荐理由:原文同时列出云端、端侧和安全评测细节,可用于理解机器人模型从演示走向部署的路径。

7月27日周一
  1. Hugging Face Blog65

    NVIDIA 发布 Cosmos-H-Dreams 实时手术机器人生成式仿真模型

    NVIDIA 推出 Cosmos-H-Dreams,这是面向手术机器人的实时、动作条件生成式仿真模型。它将 Cosmos-H-Surgical-Simulator 蒸馏为因果、少步学生模型,并通过 FlashDreams 提供流式推理,在单张 NVIDIA RTX PRO 6000 上达到交互式运行约 ~160 frames per second。

    推荐理由:原文同时交代蒸馏流程、FlashDreams 推理优化和开放资源,便于理解世界模型如何进入闭环机器人训练。

7月21日周二
7月17日周五
7月8日周三
6月23日周二
  1. Mistral AI74

    Mistral 发布 Mistral OCR 4,支持边界框、块分类和置信度分数

    Mistral 发布 Mistral OCR 4,文档解析会在提取文本外返回边界框、块类型分类和按页、按词的内联置信度分数。该模型支持 170 种语言、可在单个容器中自托管,并可作为企业搜索、RAG 和特定领域检索管线的摄取组件。

    推荐理由:原文同时给出结构化输出、部署形态和价格,可用于评估文档解析接入RAG与企业搜索的成本。

6月11日周四
6月9日周二
3月24日周二
  1. Mistral AI74

    Mistral AI 发布 Voxtral TTS 4B 文本转语音模型,支持 9 种语言

    Mistral AI 发布 Voxtral TTS,这是其首个文本转语音模型,参数量 4B,支持 9 种语言的多语言语音生成。该模型支持情绪表达、低延迟、语音适配和 zero-shot 跨语言语音适配,典型输入 10 秒语音样本和 500 字符时模型延迟为 70ms,RTF ≈9.7x。

    推荐理由:原文同时给出语言覆盖、延迟、价格、架构细节与适用场景,便于评估企业语音工作流的接入成本。

3月17日周二
2月5日周四
12月9日周二
12月3日周三
9月30日周二
9月15日周一
  1. OpenAI News74

    OpenAI 发布 GPT-5-Codex 并补充 GPT-5 system card

    OpenAI 在 GPT-5 system card 附录中介绍新模型 GPT-5-Codex,这是一个为 Codex 中智能体编码进一步优化的 GPT-5 版本。GPT-5-Codex 会根据任务复杂度更动态地调整思考投入,对简单对话查询或小任务快速响应,对更复杂任务则独立工作更久。

    推荐理由:原文说明了 GPT-5-Codex 面向 Codex 中智能体编码的优化方向,可用于了解其任务复杂度适配思路。

8月28日周四
8月7日周四
  1. OpenAI News84

    OpenAI 推出 GPT-5

    OpenAI 推出 GPT-5,称其为迄今最好的 AI 系统。OpenAI 表示,GPT-5 相比其以往所有模型在智能上有显著提升,在编码、数学、写作、健康、视觉感知等方面具备先进性能。

    推荐理由:原文列出 GPT-5 相比既有模型的覆盖领域,便于快速把握 OpenAI 对本代模型的定位。

8月5日周二
  1. OpenAI News73

    OpenAI 发布其能力最强的开放权重模型

    OpenAI 今天发布其称为能力最强的开放权重模型,称此举将让先进 AI 更开放、灵活且更易在全球访问。OpenAI 表示,其使命是把 AI 交到尽可能多人手中,AI 的下一前沿不只是能力,也包括谁能使用它。

    推荐理由:摘要明确指向 OpenAI 开放权重模型发布,可用于了解其在开放可用性和全球访问上的叙事。

  2. OpenAI News85

    OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 开放权重语言模型

    OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b,两款开放权重语言模型采用 Apache 2.0 license。它们强调低成本的现实表现,在推理任务上优于同等规模开放模型,具备较强工具使用能力,并针对消费级硬件高效部署优化。

    推荐理由:原文同时给出开源许可、低成本部署和推理表现,便于比较开放权重模型取向。

4月30日周三
4月16日周三
  1. OpenAI News84

    OpenAI 发布 o3 和 o4-mini

    OpenAI 发布 o3 和 o4-mini,称其为迄今最聪明、能力最强的模型,并具备完整工具访问能力。Feed 仅提供摘要,未包含更多功能、评测或开放细节。

    推荐理由:原文虽为摘要,但交代了 o3 与 o4-mini 的定位和完整工具访问这一核心变化。