OpenAI在最新一屆DevDay上集中釋出了二十多項更新,核心是把ChatGPT從「響應需求」的工具,改造成一套能長期承擔工作的Agent系統。整場釋出會約一小時,最受關注的新品是常駐Agent Dot、人機共享工作空間 ChatGPT Space,以及升級版模型 GPT-6.1 Sol。
Dot被放在釋出順序的最前面。它是一個24小時線上的個人Agent,使用者不必每次重新交代背景,也不用一直盯著它。每個Dot擁有自己的身份與許可權體系,配有一台獨立的雲端電腦和瀏覽器,可連線 4000多個應用,同時處理多個專案。使用者可以自定義它的名字、形象和角色,也能隨時進入它的雲電腦檢視進度,或授權它連線自己的筆記本。Dot支援網頁、桌面和手機端,使用者可以直接發訊息甚至打電話,它也會主動彙報進度、提問或等待決策,同一Dot在不同渠道間保持上下文。除ChatGPT外,目前已支援 Slack 和 Teams,後續將接入簡訊。OpenAI表示未來會讓多個Dot組成團隊協同工作。Dot正逐步開放給Pro、Business Premium和Enterprise使用者,第一個Dot包含在Pro和Business Premium訂閱內,聊天本身不消耗ChatGPT用量,但呼叫Codex或Work任務仍會正常扣額度。
ChatGPT Space則取代了原有的Library,定位為人與Agent的共享工作空間。使用者可以把檔案、頁面、簡報、表格和專案資料放進同一個Space,再隨時@ChatGPT、Codex或Dot基於共享內容繼續工作。其核心元件叫 Page,是一種可多人即時編輯的文件,形態上類似線上協作文件,支援文字、圖片、圖表和互動工具,ChatGPT或Dot可直接修改內容、整理清單、補圖表或繼續研究,Pages還能從已連線的工具持續獲取資訊並自動更新。Space面向Pro、Business和Enterprise開放,網頁端和桌面端可建立、編輯與協作,移動端首發階段僅支援查詢、閱讀和分享。協作版Slides和Spreadsheets尚未上線。
模型方面,GPT-6.1 Sol 是GPT-6 Sol的升級版。按OpenAI的定位,它在複雜程式設計、電腦操作和專業工作上接近 GPT-6 Astra 的水平,但價格維持在Sol檔,僅為Astra的五分之一。API定價為輸入 2美元/百萬Token、輸出 10美元/百萬Token、快取輸入 0.1美元。現場展示的Agent相關基準中,程式設計評測DeepSWE v1.1上GPT-6.1 Sol達到 75.22%,略高於Astra的73.23%;電腦操作評測OSWorld 2.0上約為 71.42%,Astra為73.49%;但在科學任務Terminal-Bench Science上,Astra仍以 68.10%對57.02% 明顯領先。該模型已開放給Plus、Pro、Business、Enterprise和Edu使用者,可在ChatGPT Work和Codex中使用,暫不進入普通Chat。
Ultrafast 模式是現場呼聲較高的一項。OpenAI早在8月就預覽過該模式,當時基於GPT-5.6 Sol,最高可達標準模式約14倍速度,最初僅面向少量API客戶。此次Ultrafast被帶到GPT-6 Astra,並正式進入ChatGPT Work和Codex。官方稱在Codex中Token生成速度最高可提升到 8倍,約 300 tokens/s;在API中最高提升到 6倍。首發僅開放給 Pro 500 以及符合條件的Enterprise和Edu工作區,其他訂閱即使額外購買credits也無法使用,除非直接走API。OpenAI預告GPT-6.1 Sol的Ultrafast模式也將在未來幾天上線。
訂閱層面,OpenAI推出月費 500美元 的 Pro 500,核心賣點是Plus的 25倍 可用額度以及GPT-6 Astra的Ultrafast模式。與此同時,此前暫停的Pro 200重新開放購買,但用量計算方式發生變化。按API標價折算,新版Pro 200對應的API消費金額大約只有舊版的一半。OpenAI的解釋是Sol和Luna已降價50%、模型會繼續變便宜,且新版訂閱加入了Dot;但Astra並未降價,因此原本衝著最強模型購買Pro 200的使用者,在同樣200美元下可用的Astra量明顯減少。
Codex此次獲得大批更新。Codex Cloud的雲端開發環境可直接複用,不必每次重建沙箱,支援跨裝置啟動與繼續任務,團隊還能共享已配置的環境、許可權和依賴。Codex CLI新增語音對話和 /agents 檢視,可把工作分給多個Agent並檢視各自進度,Prompt可直接編輯、會話可恢復,並加入內建worktree支援,讓不同Agent在隔離的Git工作樹中分別修改程式碼。程式碼審查功能也更完整,支援先看摘要和diff再追問,可讓Codex在使用者離線時於雲端跑初審,覆蓋GitHub Pull Request和GitLab Merge Request。Codex Security Cloud預設接入Daybreak Blue,可掃描整個GitHub倉庫、持續檢查新提交、調查並去重安全問題,再整理修復方案供審查。Agents API補上computer use,OpenAI直接託管底層Codex執行框架。
外掛方面,OpenAI重做了建立、提交和發現流程,使用者通過統一目錄發現和安裝外掛,並新增基於MCP的事件觸發能力,連線的應用發生指定變化時可主動喚起ChatGPT繼續工作。企業可將受支援的ChatGPT外掛接入自建網站,同一工作空間成員以各自身份和許可權登入並呼叫各自資料。其餘更新包括ChatGPT進入Slack和Microsoft Teams、會議外掛錄音並生成紀要存入Space、Slides支援多人協作、推出類似谷歌登入的ChatGPT賬號登入第三方產品、新增可分享個人資料頁、Decisions API限量預覽、Amazon Bedrock接入基於Agents API的託管Agent,以及整合零資料保留、離線自動安全審查和隱私推理的企業隱私能力。OpenAI還推出軟體市場,符合條件的企業可用已承諾給OpenAI的消費額度購買Adobe、Figma、Salesforce、ServiceNow、CrowdStrike等合作伙伴的軟體。
從整體方向看,模型能力已不再是這場釋出會的中心。一個Agent是否好用、能否穩定工作,越來越取決於模型之外的三層:Harness負責組織Agent行為,Infra提供穩定執行條件,Context決定Agent能否真正認識使用者。Dot是這套系統最明顯的入口,而ChatGPT Space、可複用的Codex雲端環境、Agents API和外掛更新,都是在為它補齊工作環境。
收費方式也在同步變化。OpenAI一邊把GPT-6.1 Sol繼續往低價推,一邊把Ultrafast、Pro 500這類高速算力單獨分層,同時把Dot這類24小時線上Agent直接裝進訂閱。一份ChatGPT訂閱買到的,正從「多少次模型呼叫」慢慢變成一整套Agent服務。
爭議同樣存在。Dot雖擁有獨立電腦、瀏覽器和4000多個應用連線能力,但在支付和交易等現實決策上,OpenAI並未放開許可權,關鍵步驟仍需使用者確認。有觀點認為,如果Agent不能碰錢、不能交易,其自主性就有限。考慮到OpenAI尚未上市,且此前曾因Agent能力而暫緩最強模型釋出,這種謹慎並不意外。但這也意味著,在向「使用者只提需求、其餘全部接手」靠近的過程中,OpenAI仍面臨能力邊界與信任建立的雙重考驗。