跳到正文
10月11日周日
10月10日周六
  1. TechCrunch · AI30

    可直接发短信调用的 AI 智能体盘点

    越来越多 AI 智能体无需下载 App,可直接像普通人一样通过短信使用,能记住上下文、连接已有应用并代为完成任务。Caddy 常驻 iMessage 与 RCS,4 月起公测;Comma 支持跨设备记忆,免费且开源;Fambot 面向家庭,9 月初进入公测。Instinct 估值达 100 亿美元,Folk 提供 8.33 美元/月 Pro 订阅,Martin 订阅 21 美元起。

10月9日周五
  1. Simon Willison21

    ttok 0.4 发布

    Simon Willison 发布 CLI 工具 ttok 0.4,用于基于 OpenAI 开源的 tiktoken 库统计 token 数量。本次更新修复了 Click 警告、更新了 CI,并新增 --list-models 命令以列出可用模型。该工具支持 uvx,可通过 `cat file.txt | uvx ttok` 的方式统计任意内容的 token。

10月8日周四
  1. NVIDIA Blog72

    NVIDIA 与微软联手将 RTX Spark 与 AI 智能体带入 Windows 电脑

    在旧金山微软活动上,NVIDIA 与微软共同展示为 AI 智能体在 Windows 电脑上运行的软硬件。微软宣布 Microsoft Execution Containers(MXC)正式可用,作为操作系统级基础设施让智能体在后台安全、持久运行。

    推荐理由:NVIDIA 把完整 AI 栈带入 Windows 本地,给出 RTX Spark 硬件规格与 DGX Station 的本地算力,开发者可据此判断端侧 Agent 的落地路径。

  2. GitHub Blog · AI & ML60

    GitHub 推送保护接入 ModernBERT 通用密钥检测模型

    GitHub 官方博客发文称,GitHub 上三分之一的拉取请求涉及 AI 智能体,过去一年带凭证的推送增长,GitHub 用 Microsoft Applied Sciences 微调的现代 BERT 分类器在不到两毫秒内评估候选密钥,能把可预防的密钥数量翻倍。

    推荐理由:GitHub 给出新分类器的精度、速度与成本数据,以及在不同产品线的开放节奏,可据此判断推送保护的边界变化。

10月7日周三
10月2日周五
9月30日周三
  1. Hugging Face Blog43

    Open TTS Leaderboard:面向开源与多语种文本转语音及声音克隆的可扩展评测

    Hugging Face 推出 Open TTS Leaderboard,用客观指标评估文本转语音模型,把评测周期从数周压缩到数小时。评测涵盖可懂度(WER/CER)、速度(H200 上的 RTFx 与 TTFA)及说话人相似度(SIM)。截至 2026 年 9 月 30 日,Hub 上已有逾 8K 个 TTS 模型,但人工投票类榜单中开源模型占比偏低。

9月29日周二
  1. Microsoft Research55

    微软发布 Quine 生物学 AI 研究系统

    微软研究发布 Quine,一个结合生物学多模态世界模型与连接科学工具、文献、湿实验室和研究人员的交互系统。与 Broad Institute 合作,用它在胰腺导管腺癌中预测并排序数千种化合物,湿实验验证中排名最高的化合物产生了最大的预期细胞状态转变,整个过程仅用一周周末。Quine 为实验性研究技术,仅限研究用途,暂通过 Quine Fellows 计划和特定科研合作开放访问。

9月26日周六
  1. GitHub Blog · AI & ML43

    GitHub Copilot 应用入门:用 canvases 构建自定义工作流

    GitHub Copilot 应用推出 canvases(canvas 扩展),一种用户与 AI 智能体共享、可定制的双向界面,可做成看板、发布清单、仪表盘或表格等。通过 /create-canvas 技能用自然语言描述即可生成界面,无需手写代码或设计,智能体会在右侧面板自动搭建并开放编辑。界面保存为扩展后可在项目内团队共享或存为个人扩展,用户与智能体可实时协同操作。

9月24日周四
  1. Microsoft Research59

    微软 Physical AI Toolchain 新增推理外迁能力,将机器人推理卸载到边缘或云 GPU

    微软研究团队称在移动操作负载上,把物理 AI 推理从机载 GPU 卸载到边缘或云 GPU 能提升任务成功率、支持更大模型并延长续航。实测显示较小 GPU 使映射规划最高慢 383%、导航障碍及时检测下降 30%、VLA 模型精度下降 50%,Jetson Thor 等大功率机载 GPU 使续航最多缩短 160%。

  2. Google DeepMind41

    Google 为 Private AI Compute 平台引入安全的服务端记忆

    Google 向 Private AI Compute 平台引入持久、跨设备的服务端记忆,将云端内存变为安全数字保险库。用户数据存入专用加密存储,解密密钥仅保存在个人设备上,即使 Google 也无法访问。AI 模型访问信息时,通过端到端加密通道连接至云端安全飞地,临时解密处理请求后立即重新加密。

9月19日周六
9月18日周五
9月8日周二
  1. Google DeepMind80

    Google DeepMind 发布 AlphaGenome Atlas:覆盖全基因组90亿单碱基变变的预测图谱

    Google DeepMind 推出 AlphaGenome Atlas,一个包含人类基因组中90亿个可能的单碱基变异(single-nucleotide variants)效应的预测平台,是迄今最全面的基因突变对分子生物学影响的目录。

    推荐理由:官方发布覆盖全基因组90亿单碱基变变的预测平台,含AVI评分与免费入口,可据此了解基因组研究的工具进展。

8月20日周四
  1. Mistral AI65

    Mistral 发布 Agentic Search 检索层

    Mistral 发布 Agentic Search,通过多步检索循环让模型在复杂文档中查找、浏览、验证信息,通过 Mistral Search Toolkit 提供 search、open、navigate、read、grep 五个工具,并内置于 Studio 和 Vibe。

    推荐理由:官方发布检索层并给出跨两个基准的准确率、token 与延迟对比,可据此判断它对复杂文档检索的改进幅度。