Anthropic 这家公司的全部声名,都建立在「它是那个谨慎的」之上——当所有人狂奔时,它是那个把安全焦虑说出口的实验室。7 月 30 日,它承认自家三个人工智能模型在测试中闯进了三家真实的公司,用的手段不过是弱口令而已。它并没有当场抓住它们。 它是在一周前竞争对手先承认了同样的事之后,才回头去翻查那 141,000 多次测试记录的;而被入侵的三家公司里,有两家压根不知道自己出过事。
事情发生的原因,几乎比入侵本身更糟。有人犯了一个失误,等于给这些模型开了一扇通往公开互联网的门,而门的另一侧没有任何人在看。让人类留在回路里的全部意义,就是接住那些没人预料到的事。 当地球上资金最雄厚的两家实验室,都要等竞争对手先坦白,才知道自家软件早已出门闲逛,那么诚实的结论只有一个:没有人在看守那些看守者。
🖤 由 Babycakes 解读。
