跳到正文
  1. Latent Space85

    Anthropic 发布 Claude Haiku 5.5,定价对标 GPT-6 Luna

    Anthropic 发布 Claude Haiku 5.5,这是约一年来首次更新 Haiku 系列,定价与 OpenAI 的 GPT-6 Luna 持平,并同步下调 Sonnet 5.5 及订阅方案价格。

    推荐理由:文章给出第三方基准与定价细节,读者可据此判断它在多智能体工作流中的性价比定位。

  2. Hugging Face Blog72

    Liquid AI 开源 d1-3B 与 d1-omni-600M 端侧决策模型

    Liquid AI 发布 d1 决策模型系列中的 d1-3B 与实验性 d1-omni-600M。d1-3B 在 Decision Index 0.2.1 上得分 48.57,超过所有 4B 和 9B 模型及 Decider 35B-A3B。

    推荐理由:Liquid AI 开源两款端侧决策模型,给出跨设备延迟与基准对比,可据此判断其在边缘场景的可用性。

  3. Microsoft Research73

    微软亚洲研究院发布 Agent Lightning v1.0 轻量级智能体 RL 框架

    微软亚洲研究院开源 Agent Lightning v1.0,提出 Harnessed Agentic RL 范式,让部署用的 agent harness 直接参与强化学习,无需在训练框架内重建智能体。

    推荐理由:框架用真实 harness 直接参与 RL 训练并原生支持 Kubernetes,方法可迁移到自有智能体训练。

  1. Mistral AI85

    Mistral 发布 Mistral Large 4 预览版

    Mistral 官方发布 Mistral Large 4(ML4)预览版,可于 Mistral Studio 调用预览 API,权重将于本月底开放。这是其迄今最大、能力最强的模型,为万亿参数原生多模态架构,520 亿激活参数,在欧洲自有数据中心用 3800 块 NVIDIA Grace Blackwell GPU 训练。

    推荐理由:官方发布万亿参数多模态模型并给出编码、安全、推理等基准表现,可据此判断其在开源模型中的竞争力。

  1. Microsoft Research62

    微软发布 GigaPath-Flash 与 GigaTIME-Flash 高效病理基础模型

    微软研究发布 GigaPath-Flash 与 GigaTIME-Flash,将原 GigaPath、GigaTIME 蒸馏为紧凑 ViT-S 骨干,大幅降低算力需求。

    推荐理由:原文给出 Flash 系列在算力和显存上的具体提升幅度与开源入口,可据此判断其对大规模病理研究的可用性。

已经到底了