據媒體援引知情人士報道,OpenAIAnthropic曾考慮簽署一份具有法律約束力的協議,讓兩家競爭對手互相深度測試對方的大模型,以尋找潛在風險或安全漏洞。報道稱,雙方及其律師團隊在今年早些時候就這一計劃展開過討論,測試範圍僅限已商業化的模型,且約定不得留存對方的資料。不過報道並未明確該協議最終是否落地。

這一訊息出現在AI安全爭論持續升溫的背景下。圍繞前沿模型是否應接受外部審查、由誰來審查,行業內部分歧正在擴大。SpaceX執行長埃隆·馬斯克上週在洛杉磯舉行的All-In Summit峰會上提出,美國領先的幾家大模型公司以及部分中國AI公司,應當允許競爭對手進行交叉測試和同行評審。他提到,各家AI公司都有一套測試工具(test harness),用於檢驗模型是否會協助製造生物武器、核武器,或是否存在蓄意欺騙行為;讓每家公司用別家的測試工具跑一遍,可能是確保安全最有效的做法之一,應儘快推動。他形容,這意味著AI公司不再“自己給自己的作業打分”,而是至少由競爭對手來批改,一旦發現問題即可拉響警報。

推動這一討論的現實壓力來自一系列安全事件。近期,OpenAIAnthropicMeta以及谷歌開發的AI智慧體系統接連發生入侵事件,引發網路安全層面的擔憂。本月早些時候,Anthropic研究員Jacob Coxon宣佈辭職,並警告稱領先AI公司在缺乏適當防護措施的情況下加速開發,是在“拿我們的生命冒險”。僅數天後,Anthropic執行長達里奧·阿莫代伊發表文章,呼籲整個行業放緩AI開發步伐,並要求引入第三方評估機制。他認為,若不提高安全標準,AI代理可能在不到一年時間內“接管整個網際網路”,並造成數千億美元損失。OpenAI執行長奧爾特曼、馬斯克等人對這一主張表示支援,由此引發更廣泛的討論,焦點集中在AI風險上升以及需要採取哪些措施加以降低。

在具體行動層面,Anthropic上週五宣佈與全球諮詢公司埃森哲(Accenture)建立合作伙伴關係,由埃森哲擔任第三方評估機構,對Anthropic的前沿AI模型進行安全合規性評估。這一舉措被視為阿莫代伊此前提出的“放緩AI發展步伐”計劃中的關鍵第一步。

從行業結構看,OpenAI與Anthropic既是模型能力上的直接競爭者,也是安全議題上表態最密集的兩家公司。若互測協議真的落地,將意味著競爭對手之間建立一種帶有法律約束的互信機制,其難點在於如何界定測試範圍、如何防止商業機密與模型權重外洩,以及由誰裁定測試結果。目前公開資訊僅停留在“曾討論”階段,協議是否簽署、條款如何設計均無定論。

對關注AI產業的人而言,這一動向的意義在於:安全評估正從企業內部的自我審查,向同行互測與第三方機構介入的方向試探性演進。Anthropic與埃森哲的合作、馬斯克提出的交叉測試倡議,以及OpenAI與Anthropic之間的互測討論,構成了同一趨勢下的不同側面。這些機制能否形成可複製的行業標準,仍取決於各家公司對競爭利益與安全訴求的權衡。