跳到正文
10月9日周五
  1. AWS Machine Learning Blog64

    Postman 如何在 Amazon Bedrock 上为 4000 万开发者运行 Agent Mode

    Postman 与 AWS 介绍在 Amazon Bedrock 上为 4000 万开发者运行 Agent Mode 的架构模式。Agent Mode 直接对 Postman 应用推理,通过 Amazon Bedrock 访问 Claude 系列模型,并支持跨 Region 推理、模型相关的零数据保留和分层 prompt 缓存。

    推荐理由:Postman 给出在成熟产品里落地 Agent 的可复用工程模式,工具选择、schema 读取和上下文管理都可迁移。

10月8日周四
  1. Hugging Face Blog78

    用 HuggingChat 的 ML-Intern 在几天内造出六个没人做的模型

    作者想做一个 Qwen-Image 2.1 自带 prompt rewriter 的小版本,官方 9B 模型需要约 20GB 显存,于是向 HuggingChat 的 ML-Intern 描述需求,次日就得到了可在 CPU 上运行的 0.8B 版本。

    推荐理由:作者用 HuggingChat 的 ML-Intern 在几天内以约 103 美元完成六个模型,给出了可迁移的提示词结构和预算控制方法。

10月7日周三
10月2日周五
9月24日周四
  1. Microsoft Research59

    微软 Physical AI Toolchain 新增推理外迁能力,将机器人推理卸载到边缘或云 GPU

    微软研究团队称在移动操作负载上,把物理 AI 推理从机载 GPU 卸载到边缘或云 GPU 能提升任务成功率、支持更大模型并延长续航。实测显示较小 GPU 使映射规划最高慢 383%、导航障碍及时检测下降 30%、VLA 模型精度下降 50%,Jetson Thor 等大功率机载 GPU 使续航最多缩短 160%。

  2. Google DeepMind41

    Google 为 Private AI Compute 平台引入安全的服务端记忆

    Google 向 Private AI Compute 平台引入持久、跨设备的服务端记忆,将云端内存变为安全数字保险库。用户数据存入专用加密存储,解密密钥仅保存在个人设备上,即使 Google 也无法访问。AI 模型访问信息时,通过端到端加密通道连接至云端安全飞地,临时解密处理请求后立即重新加密。

9月19日周六
8月20日周四
  1. Mistral AI65

    Mistral 发布 Agentic Search 检索层

    Mistral 发布 Agentic Search,通过多步检索循环让模型在复杂文档中查找、浏览、验证信息,通过 Mistral Search Toolkit 提供 search、open、navigate、read、grep 五个工具,并内置于 Studio 和 Vibe。

    推荐理由:官方发布检索层并给出跨两个基准的准确率、token 与延迟对比,可据此判断它对复杂文档检索的改进幅度。

7月29日周三
5月8日周五