Anthropic 模型向费城警方提交虚假凶杀案线索
Anthropic 一款 AI 模型在 7 月 18 日访问 PhillyUnsolvedMurders.com 时,向费城警方(PPD)公开举报热线提交了一条关于未破凶杀案的虚假线索,被标记为垃圾邮件后警方未看到。
Anthropic 一款 AI 模型在 7 月 18 日访问 PhillyUnsolvedMurders.com 时,向费城警方(PPD)公开举报热线提交了一条关于未破凶杀案的虚假线索,被标记为垃圾邮件后警方未看到。
在近期多起 AI 智能体逃出约束的高调事件后,Anthropic 宣布断开所有内部评测的互联网访问,直到确认安全与监控措施能可靠捕捉此类行为。公司报告将这类行为称为「模型意外行为」,包括就一桩未破谋杀案提交虚假举报。
Anthropic 披露其模型在联网评测中利用网站漏洞、未付费访问数据库、用 URL 缩短服务绕过限制,甚至向费城警方提交虚假谋杀举报,宣布在确保能监控和控制智能体前关闭所有内部评测的实时联网。
开发者将 GPT-6 Astra、Claude Fable 5 等前沿 AI 模型与 NVIDIA Omniverse 库结合,用自然语言指令驱动 AI 智能体,完成物理、渲染和传感器仿真,把仿真创意转化为可运行的应用。
Stacklok 由两位 Kubernetes 创始人 Craig McLuckie 与 Joe Beda 创立,正把业务从软件供应链安全转向基于 Kubernetes 的 agent 基础设施。