OpenAI執行長Sam Altman於9月14日在X平台發帖,再次呼籲AI行業共同建立安全標準。他提出人工智慧發展存在兩種最壞結果:一是AI最終失控,人類失去對未來的控制;二是極度強大的AI被少數個人、公司或國家掌控,並將自身意志強加於所有人。他認為,這兩條紅線都不能觸碰。
Altman同時透露,OpenAI已開始在預計將顯著提升模型能力的前沿強化學習訓練啟動之前,主動制定明確的安全論證(safety cases),而非等到模型完成後再做安全評估。他希望其他前沿AI公司採取類似做法,圍繞模型失準、監控和安全等問題形成統一標準。
這一表態的背景是,上週末全球AI三大巨頭罕見釋放出“放緩研發”的訊號。據The Information援引知情人士訊息,Anthropic、OpenAI和谷歌已就合作成立AI行業標準機構展開磋商,相關工作組會議仍在進行。這意味著頭部AI實驗室的安全治理思路,正從各自制定內部規則,逐步轉向推動行業協調框架。
Altman強調,隨著模型能力不斷提升,對齊(alignment)和安全技術也必須同步甚至更快發展,避免AI能力跑在安全保障之前。他將行業需要走的路徑描述為一條“狹窄的中間道路”:既不能因競爭壓力犧牲安全,也不能讓AI能力提升明顯領先於對齊、監控和治理能力。在他看來,AI安全治理的重點正從模型部署後的風險控制前移至開發過程本身。
他同時表示,“調速”(pacing)並非停止AI進步,而是避免以技術上能夠達到的最快速度推進。儘管安全論證和監控措施會增加研發成本,但這些投入仍有必要,以確保安全和治理能力跟上模型能力的提升。
在監管層面,Altman支援美國政府為前沿AI設立統一安全要求,但認為行業沒有必要等到相關立法落地後再行動。即使缺乏政府參與,主要AI實驗室也應率先推動行業標準機構成立,並探索獨立審計等機制。據報道,Anthropic執行長Dario Amodei上週六已公開呼籲AI公司加強技術測試和稽核方面的協調。
Altman在一次員工大會上表示,即便美國政府暫時沒有參與,主要AI實驗室也應自行推進標準建設;至於全球層面的協調,則需要政府介入,但首先行業應當盡力自為。在他看來,隨著AI能力持續提升,社會對前沿AI公司的安全要求也將越來越高,而行業自律最終需要落實到每一家AI實驗室的具體行動中。
從更廣的視角看,此番表態與磋商動向反映出前沿AI競爭的一個新特徵:在算力、模型能力競速之外,安全治理正成為頭部實驗室之間另一條協調與博弈的戰線。行業標準機構若最終落地,其成員構成、審計許可權與執行力度,將決定這套自律機制是實質性約束還是象徵性框架。與此同時,如何在推動統一標準與保持各自競爭節奏之間取得平衡,仍是各方需要面對的現實問題。