AI 行业能否通过废除保密协议来说服数据中心反对者?
亚马逊在一份论证数据中心对社区有利的博客文中宣布,与地方政府谈判时不再使用保密协议(NDAs),此前微软已率先跟进。三位 TechCrunch 播客主持人在 Equity 节目中就此讨论:有人质疑数据中心暂停令仅持续一两年、而数据中心未来数年才上线,实际影响有限;也有人认为行业在沟通上表现糟糕,废除保密协议只是开启对话的第一步。
亚马逊在一份论证数据中心对社区有利的博客文中宣布,与地方政府谈判时不再使用保密协议(NDAs),此前微软已率先跟进。三位 TechCrunch 播客主持人在 Equity 节目中就此讨论:有人质疑数据中心暂停令仅持续一两年、而数据中心未来数年才上线,实际影响有限;也有人认为行业在沟通上表现糟糕,废除保密协议只是开启对话的第一步。
微软 CEO 纳德拉在最新博客中弃用"人工智能"、改用特朗普偏爱的"超级智能"表述,并借网络安全视角抨击 OpenAI 与 Anthropic。他主张将 AI 模型视为内部安全威胁,要求以模型多样性替代对单一模型的依赖、完整记录所有操作、独立审计,并允许随时人工关停。文章认为其真实动机是商业策略,因微软缺乏自有前沿模型,担忧 AI 成为主要计算机界面后自身将受制于人。
微软 CEO 萨提亚·纳德拉在 X 平台发文,呼吁为高度智能的 AI 模型装上"紧急刹车"。他主张应默认模型已被攻破并加以管控,授权人员需能在任务中途暂停或关闭模型,并留下防篡改的人可读证据。其建议与业界多方观点一致,包括及时披露事件、独立审计、可验证数据与模型隔离。
微软 CEO 萨提亚·纳德拉在周六早间的帖子中表示,是时候"退一步,评估 AI 的信任架构"了。他提出 AI 模型需要一套"紧急刹车"机制。
微软推出自有决策模型 Decision-1,基于 Qwen3.5-9B,面向分类、评估与路由等快速结构化决策。微软称其在近 15 万题、36 个 benchmark 中准确率最高,达 83.5%,延迟 85 ms,领先 Jev 1.13.0;速度是第二名 H2O-Lightning-4B 的 2.5 倍。
MIT Technology Review 记者 Arthur Holland Michel 撰文指出,现代大模型已将“拒绝”内化为安全核心机制,但这一机制并不可靠。
微软在时隔两年的首场发布会推出 Surface Laptop Ultra,这是首款搭载 Nvidia RTX Spark SoC 的设备,起售价 2599 美元,10 月 16 日开始发货,现已开放预购。
在旧金山微软活动上,NVIDIA 与微软共同展示为 AI 智能体在 Windows 电脑上运行的软硬件。微软宣布 Microsoft Execution Containers(MXC)正式可用,作为操作系统级基础设施让智能体在后台安全、持久运行。
推荐理由:NVIDIA 把完整 AI 栈带入 Windows 本地,给出 RTX Spark 硬件规格与 DGX Station 的本地算力,开发者可据此判断端侧 Agent 的落地路径。
GitHub 官方博客发文称,GitHub 上三分之一的拉取请求涉及 AI 智能体,过去一年带凭证的推送增长,GitHub 用 Microsoft Applied Sciences 微调的现代 BERT 分类器在不到两毫秒内评估候选密钥,能把可预防的密钥数量翻倍。
推荐理由:GitHub 给出新分类器的精度、速度与成本数据,以及在不同产品线的开放节奏,可据此判断推送保护的边界变化。
微软亚洲研究院开源 Agent Lightning v1.0,提出 Harnessed Agentic RL 范式,让部署用的 agent harness 直接参与强化学习,无需在训练框架内重建智能体。
推荐理由:框架用真实 harness 直接参与 RL 训练并原生支持 Kubernetes,方法可迁移到自有智能体训练。
微软研究员 Jennifer Neville 与 Microsoft Research 的 Chad Atalla 在微软研究播客中探讨评估在推动 AI 系统性能、满足用户需求中的作用,以及模型在传统 benchmark 之外被测试时出现的"令人意外的失败"。她分享了与当前 AI 系统协作的实用建议,并强调当结果违背预期时,仔细审视数据的重要性。
微软与 Hugging Face 联合发布 ThinkingBox 智能体基准,通过隔离的 MCP 工具会话运行智能体,对后端终态和副作用打分而非只看生成文本,并在 507 个有状态业务流程上每个任务重复运行 20 次。
推荐理由:微软联合 Hugging Face 发布 ThinkingBox 智能体基准,按后端终态而非生成文本打分并重复 20 次,给出可靠性与成本对比。
微软研究院实习生开发了一套机器学习系统,对美国大陆 66,935 个变电站预测空间天气风险,可提前 30 至 60 分钟预警。系统结合 L1 拉格朗日点太阳风观测、地磁指数预测与地质电导率,生成分站点风险估计。2020—2026 年评估中,AE 预测 410.2 nT RMSE 优于经验基线,极端事件检测率达 64.1%。
微软研究发布 Quine,一个结合生物学多模态世界模型与连接科学工具、文献、湿实验室和研究人员的交互系统。与 Broad Institute 合作,用它在胰腺导管腺癌中预测并排序数千种化合物,湿实验验证中排名最高的化合物产生了最大的预期细胞状态转变,整个过程仅用一周周末。Quine 为实验性研究技术,仅限研究用途,暂通过 Quine Fellows 计划和特定科研合作开放访问。
2025年7月24日,微软亚洲研究院(新加坡)作为微软在东南亚的首个研究实验室正式启用,以连接微软前沿AI研究与新加坡高校、政府及产业生态。过去一年,其工作围绕下一代AI模型与智能体系统、面向真实场景的行业专用AI、AI原生研究实践及生态与人才培养四大支柱展开,在医疗、金融、教育等领域推动前沿研究向实际应用转化。新加坡经济发展局、IMDA等机构成为重要合作伙伴,共同培养新一代AI研究人才。
微软研究团队称在移动操作负载上,把物理 AI 推理从机载 GPU 卸载到边缘或云 GPU 能提升任务成功率、支持更大模型并延长续航。实测显示较小 GPU 使映射规划最高慢 383%、导航障碍及时检测下降 30%、VLA 模型精度下降 50%,Jetson Thor 等大功率机载 GPU 使续航最多缩短 160%。
微软研究团队在 Nature 发表合成预测模型 RetroChimera,将基于 Transformer 的 R-SMILES 2 与基于图神经网络的 NeuralLoc 两个互补子模型结合,用学习排序策略聚合预测,在罕见反应类型、零样本迁移和微调上表现良好。
微软研究发布 GigaPath-Flash 与 GigaTIME-Flash,将原 GigaPath、GigaTIME 蒸馏为紧凑 ViT-S 骨干,大幅降低算力需求。
推荐理由:原文给出 Flash 系列在算力和显存上的具体提升幅度与开源入口,可据此判断其对大规模病理研究的可用性。