想象一下:你正在上班,偶然发现一个用户正在写下一份大规模枪击的详细计划——暴力手段、袭击目标,一应俱全。你和同事们标记了它,并争论要不要报警。负责人决定:不报。他们只是关掉了他的账号,他又注册了一个新账号,几个月后,他走进一所学校,杀死了八个人,其中五个是 12 岁和 13 岁的孩子。这家公司预见了这一切,却没告诉任何人。
为什么这事关重大:这家公司的辩护理由是,他们所看到的内容没有通过他们自己设定的“威胁严重到需要上报”的测试。一个由他们自己编写的测试,公司大楼之外没人看得见,也没有其他任何人可以核查。AI 安全的整个承诺就是“别担心,有人在盯着呢。”人确实在盯着,他们看到了一切,可任何地方都没有任何规定说他们必须拿起电话。
