跳到正文
原文
MIT Technology Review · AI· Arthur Holland Michel·· 3 小时前AI 评分63

我们对AI说不的能力寄予了过多信任

We’re putting too much faith in AI’s ability to say no

AI 导读

MIT Technology Review 分析指出,现代AI的拒绝能力源于对齐训练与分类器堆叠,但本质仍是概率机制,始终存在被绕过的漏洞。更深层的风险在于,当拒绝成为安全支柱时,政府也可能借机扩大审查,甚至出现模型

来源:MIT Technology Review · AI · technologyreview.com