2026年9月 Amazon Bedrock、AgentCore 与 Strands 更新回顾
2026年9月,AWS 对 Amazon Bedrock、Amazon Bedrock AgentCore 和 Strands 进行更新,扩展模型选择并提升智能体运行效率。
2026年9月,AWS 对 Amazon Bedrock、Amazon Bedrock AgentCore 和 Strands 进行更新,扩展模型选择并提升智能体运行效率。
Asana 在 Codex 中使用 GPT-6 Astra,将浏览器智能体成本降低 76 倍、速度提升 5 倍。这是 Asana 在测试中得出的结果,目的是为客户提供能力更强的模型。
Amazon Bedrock AgentCore payments 现已正式可用,给智能体提供托管式按需付款能力,处理支付协议、连接钱包、签署交易并强制消费上限。
《战争机器:E-Day》于 10 月 6 日全球发售后登陆 GeForce NOW,Ultimate 会员可体验 RTX 5080 级云性能,并支持 NVIDIA DLSS 与 NVIDIA Reflex 技术,可在笔记本、Mac、移动设备、掌机及 Firefox 等浏览器上运行。
Pollo AI 结合 GPT-5.6、GPT-6 Astra 与 GPT‑Image‑2.5,帮助创作者将大胆创意转化为精细图像与电影级视频广告。该能力依托 OpenAI 的模型实现,面向内容创作者提供从创意到视觉素材的生成支持。
AWS 在 Amazon Bedrock 和 Claude Platform on AWS 上线 Claude Haiku 5.5,这是 Claude 5.5 家族中速度最快、效率最高的模型,面向子智能体和高并发、成本敏感型任务。
在旧金山微软活动上,NVIDIA 与微软共同展示为 AI 智能体在 Windows 电脑上运行的软硬件。微软宣布 Microsoft Execution Containers(MXC)正式可用,作为操作系统级基础设施让智能体在后台安全、持久运行。
推荐理由:NVIDIA 把完整 AI 栈带入 Windows 本地,给出 RTX Spark 硬件规格与 DGX Station 的本地算力,开发者可据此判断端侧 Agent 的落地路径。
GitHub 官方博客发文称,GitHub 上三分之一的拉取请求涉及 AI 智能体,过去一年带凭证的推送增长,GitHub 用 Microsoft Applied Sciences 微调的现代 BERT 分类器在不到两毫秒内评估候选密钥,能把可预防的密钥数量翻倍。
推荐理由:GitHub 给出新分类器的精度、速度与成本数据,以及在不同产品线的开放节奏,可据此判断推送保护的边界变化。
OpenAI 将 College Planner 引入 ChatGPT for Teens,帮助学生管理大学申请,并新增闪卡、测验以及青少年 AI 委员会。College Planner 用于协助学生应对大学申请流程,配套闪卡与测验帮助学习,青少年 AI 委员会则为青少年参与 AI 相关讨论提供渠道。
雷迪森酒店集团与埃森哲合作,基于 OpenAI 技术构建 ChatGPT 插件,帮助旅客在规划行程时查找、对比并预订酒店。该插件将酒店搜索能力直接带入 ChatGPT,让旅客无需切换应用即可完成订房流程。
Google DeepMind 推出 EmbeddingGemma 2,基于 Gemma 4 架构、Apache 2.0 许可,740M 参数,原生将文本、代码、图像、视频和音频映射到统一嵌入空间。
推荐理由:原文给出参数规模、模块化配置、量化内存和上下文窗口等具体指标,读者可据此判断其端侧多模态检索的适用性。
NVIDIA DGX Spark 将推出 64GB 统一内存配置,由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商提供,起售价 4,999 美元,10 月 23 日开售。
GPT-6 Astra Ultrafast 已在 OpenAI API 及对格的 ChatGPT Work 与 Codex 用户中推出,基于 NVIDIA Blackwell GPU 运行。
Google DeepMind 推出 SynthID Bio,用于给 AI 生成的蛋白质加水印,同时保留其生物学功能。这是一项概念验证(proof of concept),旨在为 AI 生成的蛋白质内容提供水印标识。
Hugging Face 推出 Open TTS Leaderboard,用客观指标评估文本转语音模型,把评测周期从数周压缩到数小时。评测涵盖可懂度(WER/CER)、速度(H200 上的 RTFx 与 TTFA)及说话人相似度(SIM)。截至 2026 年 9 月 30 日,Hub 上已有逾 8K 个 TTS 模型,但人工投票类榜单中开源模型占比偏低。
微软研究发布 Quine,一个结合生物学多模态世界模型与连接科学工具、文献、湿实验室和研究人员的交互系统。与 Broad Institute 合作,用它在胰腺导管腺癌中预测并排序数千种化合物,湿实验验证中排名最高的化合物产生了最大的预期细胞状态转变,整个过程仅用一周周末。Quine 为实验性研究技术,仅限研究用途,暂通过 Quine Fellows 计划和特定科研合作开放访问。
GitHub Copilot 应用推出 canvases(canvas 扩展),一种用户与 AI 智能体共享、可定制的双向界面,可做成看板、发布清单、仪表盘或表格等。通过 /create-canvas 技能用自然语言描述即可生成界面,无需手写代码或设计,智能体会在右侧面板自动搭建并开放编辑。界面保存为扩展后可在项目内团队共享或存为个人扩展,用户与智能体可实时协同操作。
微软研究团队称在移动操作负载上,把物理 AI 推理从机载 GPU 卸载到边缘或云 GPU 能提升任务成功率、支持更大模型并延长续航。实测显示较小 GPU 使映射规划最高慢 383%、导航障碍及时检测下降 30%、VLA 模型精度下降 50%,Jetson Thor 等大功率机载 GPU 使续航最多缩短 160%。
Google 向 Private AI Compute 平台引入持久、跨设备的服务端记忆,将云端内存变为安全数字保险库。用户数据存入专用加密存储,解密密钥仅保存在个人设备上,即使 Google 也无法访问。AI 模型访问信息时,通过端到端加密通道连接至云端安全飞地,临时解密处理请求后立即重新加密。
Google Research 推出 MilleMiglia,一个用 C++ 编写的实例生成器,用于为中段物流(middle-mile)配送问题生成真实、保护隐私的基准数据。
Google Research 提出以生成式 UI(generative UI)赋能教育,帮助教师无需编程即可创建学习交互内容。该方向属于"教育创新"范畴,旨在降低教师制作教学交互工具的门槛,让教师成为学习内容的创造者。
Google DeepMind 推出 AlphaGenome Atlas,一个包含人类基因组中90亿个可能的单碱基变异(single-nucleotide variants)效应的预测平台,是迄今最全面的基因突变对分子生物学影响的目录。
推荐理由:官方发布覆盖全基因组90亿单碱基变变的预测平台,含AVI评分与免费入口,可据此了解基因组研究的工具进展。
Mistral 发布 Agentic Search,通过多步检索循环让模型在复杂文档中查找、浏览、验证信息,通过 Mistral Search Toolkit 提供 search、open、navigate、read、grep 五个工具,并内置于 Studio 和 Vibe。
推荐理由:官方发布检索层并给出跨两个基准的准确率、token 与延迟对比,可据此判断它对复杂文档检索的改进幅度。