MIT Technology Review · AI· Arthur Holland Michel·· 3 天前AI 评分66
我们对AI拒绝能力的信任过度了
We’re putting too much faith in AI’s ability to say no
AI 导读
MIT Technology Review 记者 Arthur Holland Michel 撰文指出,现代大模型已将“拒绝”内化为安全核心机制,但这一机制并不可靠。
来源:MIT Technology Review · AI · technologyreview.com