跳到正文
10月9日周五
  1. AWS Machine Learning Blog64

    Postman 如何在 Amazon Bedrock 上为 4000 万开发者运行 Agent Mode

    Postman 与 AWS 介绍在 Amazon Bedrock 上为 4000 万开发者运行 Agent Mode 的架构模式。Agent Mode 直接对 Postman 应用推理,通过 Amazon Bedrock 访问 Claude 系列模型,并支持跨 Region 推理、模型相关的零数据保留和分层 prompt 缓存。

    推荐理由:Postman 给出在成熟产品里落地 Agent 的可复用工程模式,工具选择、schema 读取和上下文管理都可迁移。

10月8日周四
  1. Hugging Face Blog78

    用 HuggingChat 的 ML-Intern 在几天内造出六个没人做的模型

    作者想做一个 Qwen-Image 2.1 自带 prompt rewriter 的小版本,官方 9B 模型需要约 20GB 显存,于是向 HuggingChat 的 ML-Intern 描述需求,次日就得到了可在 CPU 上运行的 0.8B 版本。

    推荐理由:作者用 HuggingChat 的 ML-Intern 在几天内以约 103 美元完成六个模型,给出了可迁移的提示词结构和预算控制方法。

  2. NVIDIA Blog72

    NVIDIA 与微软联手将 RTX Spark 与 AI 智能体带入 Windows 电脑

    在旧金山微软活动上,NVIDIA 与微软共同展示为 AI 智能体在 Windows 电脑上运行的软硬件。微软宣布 Microsoft Execution Containers(MXC)正式可用,作为操作系统级基础设施让智能体在后台安全、持久运行。

    推荐理由:NVIDIA 把完整 AI 栈带入 Windows 本地,给出 RTX Spark 硬件规格与 DGX Station 的本地算力,开发者可据此判断端侧 Agent 的落地路径。

10月7日周三
10月6日周二
10月4日周日
  1. Hugging Face Blog80

    微软与 Hugging Face 联合发布 ThinkingBox 智能体基准

    微软与 Hugging Face 联合发布 ThinkingBox 智能体基准,通过隔离的 MCP 工具会话运行智能体,对后端终态和副作用打分而非只看生成文本,并在 507 个有状态业务流程上每个任务重复运行 20 次。

    推荐理由:微软联合 Hugging Face 发布 ThinkingBox 智能体基准,按后端终态而非生成文本打分并重复 20 次,给出可靠性与成本对比。

10月2日周五
  1. Hugging Face Blog63

    ServiceNow 发布 AutoSynthData 自动生成企业智能体训练数据

    ServiceNow CoreAI 推出 AutoSynthData,用目标模型的失败和更强教师的成功决定该学什么,自动生成并校验可执行任务,随模型进步把课程转向仍难的部分。

    推荐理由:ServiceNow 官方公布 AutoSynthData 用目标模型失败加更强教师成功自动生成并校验企业智能体训练任务的流程与实验数据。

9月26日周六
  1. GitHub Blog · AI & ML43

    GitHub Copilot 应用入门:用 canvases 构建自定义工作流

    GitHub Copilot 应用推出 canvases(canvas 扩展),一种用户与 AI 智能体共享、可定制的双向界面,可做成看板、发布清单、仪表盘或表格等。通过 /create-canvas 技能用自然语言描述即可生成界面,无需手写代码或设计,智能体会在右侧面板自动搭建并开放编辑。界面保存为扩展后可在项目内团队共享或存为个人扩展,用户与智能体可实时协同操作。

9月25日周五
9月9日周三
  1. Mistral AI53

    Mistral 用 AI 智能体将 4 万行 Fortran 77 现代化迁移到 C++

    Mistral 帮助一家欧洲能源运营商将 4 万行 Fortran 77 迁移到 C++,这是一个物理密集型储层模拟器,无测试套件、无集中文档。原文指出,迁移完整系统需要架构级重构而非单纯语法翻译,并分享了三个可复用原则:迁移前先构建 parity harness 用数值一致性验证迁移结果;先把文档整理清楚再依赖智能体;在这个规模下,带人审关口的结构化工作流优于完全自主或纯人工。

7月7日周二