核心信息

针对Anthropic发布的新文章及其承诺(允许第三方评估人员以员工级权限长期访问其AI系统),一位AI开发者回应称,AI更现实的风险并非“邪恶机器”,而是一个不受控制的失控循环,它会不断制造烦人的问题且难以拔掉电源——本质上只是一个没有恶意动机的“大Bug”。

要点

  • Anthropic宣布将从自身做起,履行“放缓前沿”文章中建议的第一步:向第三方评估人员开放系统的永久访问权限。
  • 这位开发者认为,AI的威胁更多来自无聊的工程故障,而非科幻式的末日起因。
  • 这种“失控回路”一旦跑起来,拔掉插头并不容易,因此更值得关注的是实际可操作的安全问题,而非恶意动机。