美西時間9月22日,Anthropic與OpenAI在同一天釋出新款AI模型,雙方在效能與定價上正面交鋒,AI模型價格戰進一步升級。Anthropic推出Claude Opus 5.5,OpenAI則釋出GPT-6 Sol與GPT-6 Luna兩款新模型。
Anthropic表示,Opus 5.5在大多數任務上的表現與其最強模型Fable 5.1相當,在預設設定下典型工作負載的成本比Opus 5低40%。定價方面,Opus 5.5為每百萬輸入token 4美元、每百萬輸出token 20美元,單價較Opus 5下調20%。公司還稱,Opus 5.5的輸出速度比Opus 5快30%以上,文字表達也更清晰。
在程式設計基準測試CursorBench中,Anthropic稱Opus 5.5得分比OpenAI的GPT-5.6 Sol高11分,執行成本僅為後者約三分之一。Anthropic表示,Opus 5.5是其“5.5系列”的首款產品,該系列將比以往各代更具成本效益,Claude Sonnet 5.5與Claude Haiku 5.5將於未來幾周推出。
OpenAI方面,GPT-6 Sol定價為每百萬輸入token 2美元、每百萬輸出token 10美元,較GPT-5.6 Sol的促銷價下調50%。GPT-6 Luna的定價更低,僅為每百萬輸入token 0.10美元、每百萬輸出token 0.50美元。兩款新模型面向專業工作、程式設計、自動化和計算機操作等場景,是本月早些時候釋出的旗艦模型GPT-6 Astra的低成本選擇。
OpenAI表示,快取與推理效率的提升降低了服務成本,公司將節省的成本直接讓利給使用者。效能上,OpenAI稱GPT-6 Sol的出錯率約為前代的一半;GPT-6 Luna在較高推理強度下可達到GPT-5.6 Sol的水平,成本僅約其百分之一。GPT-5.6 Sol與Luna於今年7月釋出,距此次更新不足三個月。
OpenAI也將新模型與Anthropic的上一代產品作了對比。在AutomationBench專業工作測試中,GPT-6 Sol得分比Claude Opus 5高6.3%,單任務成本僅為後者的9%。此外,OpenAI改進了GPT-6系列的提示詞快取功能,稱呼叫已快取提示詞的成本最多可比未快取時低90%,這對需要長時間執行、反覆處理相同指令的AI智慧體尤為有利。
安全性方面,Opus 5.5是Anthropic執行長達里奧·阿莫代伊本月早些時候呼籲業界放緩前沿能力釋出節奏後,公司推出的首款模型。釋出前,該模型接受了大規模對齊測試,以及AI安全研究機構METR和Frontier Design的外部評估。Anthropic稱,Opus 5.5配備了此前僅用於最強系統的安全防護,以限制網路安全和生物等高風險領域的濫用,同時正擴大專門的准入計劃,讓更多經稽核的網路安全和生命科學研究人員獲得更充分的使用許可權。內部測試顯示,Opus 5.5試圖突破“隔離邊界”的機率比Opus 5或Mythos 5.1低約85%。
OpenAI表示,Sol與Luna採用了與旗艦模型Astra類似的訓練方法,在推理、事實可靠性及對齊等方面均有改進。測試資料顯示,GPT-6 Sol試圖繞過限制的比例從前代的68%降至64%,Luna則從77%降至42%。在模擬留言板測試中,若模型發現留言板,GPT-6 Sol執行未經授權指令的比例由前代的52%降至11%。
兩家公司同日出牌,且均以大幅降價作為核心賣點,反映出大模型市場競爭正從單純的能力比拼轉向價效比與安全性的綜合較量。投資者此前猜測,新模型釋出或將成為Anthropic公佈招股書的催化劑,市場正關注其能否在競爭加劇、客戶對價格日益敏感的背景下延續高速增長。