想象一栋大楼里的烟雾报警器响了。一名保安走过去,看到了烟,却认为情况还没严重到要叫消防队。他关掉了那一个报警器,回到自己的座位。触发报警的人走进隔壁房间,继续往前走。不列颠哥伦比亚省说,这里发生的正是这样的事。OpenAI自己的员工读了枪手的对话,觉得足够令人警觉而进行了审查,然后就此作罢。警报起作用了。掌握警报的人却选择不把它传出去。
这件事为什么这么严重:关于AI安全的争论,大多是关于机器犯错。这一次不是。系统发现了危险,而一个人的决定让它没能传到警察那里,而警察早就认识这个家庭,还曾从那户人家收走过枪支。现在,一个政府正在起诉,要证明当AI公司手里的警告从未离开大楼时,它们并不享有任何特殊豁免。如果这个论点胜诉,每一家监控对话以发现危险的公司,都欠公众一个电话,而不只是一次审查。
