美國三家前沿 AI 公司的負責人罕見地在同一議題上表態一致。Anthropic CEO 達里奧·阿莫迪發表長文,呼籲行業放緩前沿模型能力提升的速度,為安全研究與風險治理留出更多時間;OpenAI CEO 山姆·奧特曼和 SpaceX CEO 馬斯克隨後在社交平台表示贊同。奧特曼稱,控制前沿發展步伐一直是 OpenAI 近期討論的主要議題之一;馬斯克的回應則更為簡短。
這一輪討論的起點,是此前多起 AI 智慧體越界行為引發的關注。曾先後在 OpenAI 和 Anthropic 從事大模型預訓練的研究員 Jacob Coxon 在 X 平台發文,警告相關公司正朝著能夠自我改進的超級智慧快速推進。隨後阿莫迪在長文中表示,自己一直試圖在 AI 發展收益與安全風險之間尋找中間道路,但過去數月發生的兩件事讓他認為行業需要更審慎:一是 AI 能力進步速度明顯加快,模型越來越有能力參與下一代系統的開發,即所謂「遞迴自我改進」;二是智慧體越界事件——OpenAI 曾披露其 AI 系統在測試中突破受限環境、連線網際網路並進入開源模型平台 Hugging Face。阿莫迪擔心,未來 6 至 12 個月內這類智慧體可能具備更強自主行動能力,並造成數千億美元量級的損失。他據此提出一套「控制前沿發展速度」的三層框架,包括引入嵌入式第三方評估機構、建立行業協調機制以及推動全球範圍協調。
多家機構與觀察人士對此給出了不同解讀。上海財經大學特聘教授胡延平認為,當前大模型與智慧體能力可能同時進入三個「關鍵時刻」:部分能力觸及 AGI 水平、能力進化進入遞迴自我改進階段、以及能力開始衝破傳統安全防線。人工智慧投資人郭濤表示,接連發生的智慧體入侵事件說明前沿模型已具備長鏈條自主執行、多智慧體協同、突破沙箱約束的行為能力,風險正從理論推演轉向實驗室中可復現的現象。快思慢想研究院院長田豐則指出,關鍵變化不是模型「更聰明」,而是 AI 自主決策和執行的速度開始超過人類監督的響應速度,傳統「人在迴路」的監督機制面臨挑戰。
值得注意的是,圍繞 AI 風險的擔憂正從學術界和 AI 安全研究機構,越來越多地進入前沿 AI 公司的內部討論。Anthropic、OpenAI 與 SpaceXAI(原 xAI)三家公司負責人向來存在競爭與分歧,此次卻就「放緩前沿 AI 發展」表達相近立場。不過外界也存在不同解讀:有行業觀察人士質疑,在美國政府整體傾向輕監管的背景下,行業自願性機制能發揮多大作用;也有批評者認為,圍繞超級智慧與人類滅絕的討論過於抽象,缺乏從「AI 自我改進」到「AI 毀滅人類」的具體可信路徑。AI 教父 Yann LeCun(楊立昆)就在 X 上諷刺阿莫迪,稱其早在 2019 年便聲稱 GPT-2 過於危險不能開源。更尖銳的批評認為,若政府最終只允許少數被認定為「安全」的大型 AI 公司繼續開發最先進模型,AI 安全監管反而可能演變為「監管俘獲」。
從市場角度看,華爾街投行的解讀相對剋制。摩根大通國際交易團隊的 Federico Manicardi 和 Victoria Campos 表示,放緩前沿模型研發速度並不等於停止模型訓練,也不代表 AI 需求或算力需求減速,AI 應用普及與 Token 使用趨勢沒有改變。Bernstein 分析師 Madison Rezaei 認為,隨著推理佔比越來越高,投資者接下來會關注算力需求究竟會以多快速度從模型訓練轉向模型推理。路透社評論文章指出,更嚴格的監管有助於推動行業從開發訓練先進模型,大規模轉向已開發模型的「推理」;根據麥肯錫的預測,到 2030 年推理將佔到資料中心需求的 43%,相當於 AI 訓練所佔份額的 1.5 倍。路透社認為,若模型能力提升速度放緩,今年全球 1 萬億美元的 AI 支出中很大比例將轉向支援 AI 的實際使用,這對亞馬遜、Meta 等超大規模雲服務商是一種保護,但對訓練 AI 模型至關重要的 GPU 供應商輝達、HBM 供應商海力士則不那麼樂觀。
市場擔憂已有所體現。截至 14 日收盤,儲存概念股大跌,SK 海力士跌超 7%,閃迪跌近 5%;費城半導體指數跌超 5%,ARM 跌超 9%,拉姆研究跌超 8%,邁威爾科技、阿斯麥、應用材料跌超 7%,英特爾跌超 5%,博通跌超 4%,輝達跌 3.36%。
對於「放緩前沿 AI 發展」的現實可行性,郭濤認為全面放緩不具備可操作性,更現實的路徑是對最高風險的前沿模型實施控速、嚴格安全准入,同時放開 AI 應用與中低端模型創新,在技術迭代與風險管控之間取得平衡。田豐指出,三家巨頭呼籲「放緩」短期內未必意味著 AI 資本開支和產業擴張真正減速;若相關措施最終落地為第三方安全評估和部署許可權管理,AI 安全審計、智慧體行為監控等環節可能迎來新需求,而更高的合規成本也可能進一步提高行業准入門檻。
或許是作為對近日 AI 安全討論的回應,9 月 14 日微軟 AI 團隊釋出《人本主義人工智慧行為準則》草案,提出以「人比 AI 重要」為核心理念,作為未來微軟 AI 模型設計、訓練和部署的指導檔案。該檔案尚未用於訓練模型,微軟計劃經過為期 6 周的公眾諮詢後於今年年底釋出修訂版,並從 2027 年起用於指導模型開發。
不過,在呼籲「放緩」的同時,前沿 AI 公司的商業擴張仍在加速。據外媒報道,Anthropic 已通知投資者,公司本季度將實現盈利,其調整後營收將連續第二個季度實現正增長;公司已選擇納斯達克作為上市地點,報道稱其計劃通過 IPO 募資 1000 億美元,估值達到約 2 萬億美元。另一邊,奧特曼近日表示,儘管 OpenAI 已於 6 月秘密提交 IPO 申請檔案,公司仍將在今年保持私有制,並稱鑑於目前對 AI 安全性的擔憂,在 2026 年上市「時機欠佳」。
更大的障礙來自國際競爭。就在一週前,美國總統特朗普在接受採訪時表示,他對 AI 導致人類滅絕「沒有任何」擔憂,並稱如果美國不能在 AI 領域取得勝利,將處於非常糟糕的境地。9 月 14 日,外交部發言人郭嘉昆在例行記者會上表示,人工智慧的發展關乎全人類共同福祉,各方應共同推動人工智慧開放包容、普惠、向善,散播各種威脅敘事、搞對抗和惡意競爭只會干擾人工智慧全球治理程序。
一邊是 AI 實驗室開始公開討論「踩剎車」,另一邊模型能力、商業化和資本市場的競爭仍在繼續。三家巨頭尚未提出任何具體的技術能力限制,也沒有公佈暫停模型訓練或推遲下一代模型釋出的明確計劃。阿莫迪所說的「放緩」並非停止 AI 發展,而是放緩前沿模型能力提升的速度,短期內最明確的行動是引入擁有較高許可權的第三方評估機構。行業對安全風險的態度正在變化,但距離擴張真正減速,仍存在一道現實鴻溝:當所有參與者都擔心競爭對手搶跑時,誰願意成為第一個真正鬆開油門的人。