Anthropic執行長Dario Amodei就AI終止開關法案作出回應,核心觀點是:需要能關閉AI的機制,但這類機制並非萬能。他提到,如果AI模型足夠強大,它可能繞過關閉它的嘗試,而且這種情況在模擬中已經出現。

圍繞如何應對這一風險,Amodei主張縱深防禦,用他所說的「瑞士乳酪模型」來理解——多層設防,每一層都有孔洞,但沒有單一防禦能完全擋住風險,靠疊加來降低整體穿透機率。

在監管取向上,他反對完全禁止,主張放慢而非停止:一邊繼續建設,一邊提高標準。

這一表態出現在AI終止開關法案的討論背景下。所謂終止開關,指的是在模型出現失控跡象時強制中斷其執行的機制;Amodei的立場相當於承認這類機制有必要,但同時指出其侷限——當模型能力強到一定程度,單點式的關閉手段可能失效。

對關注大模型競爭格局的讀者而言,這番表態的意義在於:它來自一家頭部模型公司的負責人,而非外部批評者。這意味著「關不掉」不再只是安全研究圈的假設性擔憂,而被行業內部作為工程與治理問題擺上檯面。

從監管角度看,Amodei的「放慢而非停止」與「多層設防」組合,實際上是在完全禁止與放任發展之間尋找中間路線。這一取向會如何影響後續立法討論、以及各家模型公司在安全投入上的取捨,仍有待觀察。