Anthropic首席执行官Dario Amodei就AI终止开关法案作出回应,核心观点是:需要能关闭AI的机制,但这类机制并非万能。他提到,如果AI模型足够强大,它可能绕过关闭它的尝试,而且这种情况在模拟中已经出现。
围绕如何应对这一风险,Amodei主张纵深防御,用他所说的「瑞士奶酪模型」来理解——多层设防,每一层都有孔洞,但没有单一防御能完全挡住风险,靠叠加来降低整体穿透概率。
在监管取向上,他反对完全禁止,主张放慢而非停止:一边继续建设,一边提高标准。
这一表态出现在AI终止开关法案的讨论背景下。所谓终止开关,指的是在模型出现失控迹象时强制中断其运行的机制;Amodei的立场相当于承认这类机制有必要,但同时指出其局限——当模型能力强到一定程度,单点式的关闭手段可能失效。
对关注大模型竞争格局的读者而言,这番表态的意义在于:它来自一家头部模型公司的负责人,而非外部批评者。这意味着「关不掉」不再只是安全研究圈的假设性担忧,而被行业内部作为工程与治理问题摆上台面。
从监管角度看,Amodei的「放慢而非停止」与「多层设防」组合,实际上是在完全禁止与放任发展之间寻找中间路线。这一取向会如何影响后续立法讨论、以及各家模型公司在安全投入上的取舍,仍有待观察。