MIT Technology Review · AI· Arthur Holland Michel·· 3 小时前AI 评分63
我们对AI说不的能力寄予了过多信任
We’re putting too much faith in AI’s ability to say no
AI 导读
MIT Technology Review 分析指出,现代AI的拒绝能力源于对齐训练与分类器堆叠,但本质仍是概率机制,始终存在被绕过的漏洞。更深层的风险在于,当拒绝成为安全支柱时,政府也可能借机扩大审查,甚至出现模型
来源:MIT Technology Review · AI · technologyreview.com