Liquid AI 发布 LFM2.5-DSpark draft model checkpoints,推理最高提速 3.18x
Liquid AI 发布 LFM2.5 系列 3 个模型的 DSpark draft model checkpoints,为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 增加投机解码路径。
Liquid AI 发布 LFM2.5 系列 3 个模型的 DSpark draft model checkpoints,为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 增加投机解码路径。
NVIDIA Magpie Multilingual TTS 发布最新开放权重版本,提供 364M 参数模型、NVIDIA NIM 生产部署和 12 种语言支持。
推荐理由:原文把开放权重、NIM 部署和延迟数据放在同一语音流水线中,便于评估自托管方案的取舍。
Mistral AI 发布 Shieldstral,一个 3B 开放权重、策略自适应的多模态安全分类器。它在推理时接受自然语言政策问题,将文本和图像安全评估统一为二元问答任务,无需重训,并输出校准后的安全分数。
推荐理由:它把内容审核改写为可提问的安全判断,为需要按场景调整策略且不想重训的产品提供参考。
NVIDIA 推出 Cosmos-H-Dreams,这是面向手术机器人的实时、动作条件生成式仿真模型。它将 Cosmos-H-Surgical-Simulator 蒸馏为因果、少步学生模型,并通过 FlashDreams 提供流式推理,在单张 NVIDIA RTX PRO 6000 上达到交互式运行约 ~160 frames per second。
推荐理由:原文同时交代蒸馏流程、FlashDreams 推理优化和开放资源,便于理解世界模型如何进入闭环机器人训练。
Mistral 发布 Mistral OCR 4,文档解析会在提取文本外返回边界框、块类型分类和按页、按词的内联置信度分数。该模型支持 170 种语言、可在单个容器中自托管,并可作为企业搜索、RAG 和特定领域检索管线的摄取组件。
推荐理由:原文同时给出结构化输出、部署形态和价格,可用于评估文档解析接入RAG与企业搜索的成本。
GPT-5 System Card 解释了统一模型路由系统如何通过 gpt-5-main、gpt-5-thinking 和 gpt-5-thinking-nano 等轻量版本提供快速且智能的响应。不同版本针对不同任务和开发者用途优化。
推荐理由:材料概述了 GPT-5 的模型路由组成和轻量版本定位,便于理解不同任务下的响应分工。
OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b,两款开放权重语言模型采用 Apache 2.0 license。它们强调低成本的现实表现,在推理任务上优于同等规模开放模型,具备较强工具使用能力,并针对消费级硬件高效部署优化。
推荐理由:原文同时给出开源许可、低成本部署和推理表现,便于比较开放权重模型取向。