OpenAI在最新一届DevDay上集中发布了二十多项更新,核心是把ChatGPT从「响应需求」的工具,改造成一套能长期承担工作的Agent系统。整场发布会约一小时,最受关注的新品是常驻Agent Dot、人机共享工作空间 ChatGPT Space,以及升级版模型 GPT-6.1 Sol。
Dot被放在发布顺序的最前面。它是一个24小时在线的个人Agent,用户不必每次重新交代背景,也不用一直盯着它。每个Dot拥有自己的身份与权限体系,配有一台独立的云端电脑和浏览器,可连接 4000多个应用,同时处理多个项目。用户可以自定义它的名字、形象和角色,也能随时进入它的云电脑查看进度,或授权它连接自己的笔记本。Dot支持网页、桌面和手机端,用户可以直接发消息甚至打电话,它也会主动汇报进度、提问或等待决策,同一Dot在不同渠道间保持上下文。除ChatGPT外,目前已支持 Slack 和 Teams,后续将接入短信。OpenAI表示未来会让多个Dot组成团队协同工作。Dot正逐步开放给Pro、Business Premium和Enterprise用户,第一个Dot包含在Pro和Business Premium订阅内,聊天本身不消耗ChatGPT用量,但调用Codex或Work任务仍会正常扣额度。
ChatGPT Space则取代了原有的Library,定位为人与Agent的共享工作空间。用户可以把文件、页面、演示文稿、表格和项目资料放进同一个Space,再随时@ChatGPT、Codex或Dot基于共享内容继续工作。其核心组件叫 Page,是一种可多人实时编辑的文档,形态上类似在线协作文档,支持文字、图片、图表和交互工具,ChatGPT或Dot可直接修改内容、整理清单、补图表或继续研究,Pages还能从已连接的工具持续获取信息并自动更新。Space面向Pro、Business和Enterprise开放,网页端和桌面端可创建、编辑与协作,移动端首发阶段仅支持查找、阅读和分享。协作版Slides和Spreadsheets尚未上线。
模型方面,GPT-6.1 Sol 是GPT-6 Sol的升级版。按OpenAI的定位,它在复杂编程、电脑操作和专业工作上接近 GPT-6 Astra 的水平,但价格维持在Sol档,仅为Astra的五分之一。API定价为输入 2美元/百万Token、输出 10美元/百万Token、缓存输入 0.1美元。现场展示的Agent相关基准中,编程评测DeepSWE v1.1上GPT-6.1 Sol达到 75.22%,略高于Astra的73.23%;电脑操作评测OSWorld 2.0上约为 71.42%,Astra为73.49%;但在科学任务Terminal-Bench Science上,Astra仍以 68.10%对57.02% 明显领先。该模型已开放给Plus、Pro、Business、Enterprise和Edu用户,可在ChatGPT Work和Codex中使用,暂不进入普通Chat。
Ultrafast 模式是现场呼声较高的一项。OpenAI早在8月就预览过该模式,当时基于GPT-5.6 Sol,最高可达标准模式约14倍速度,最初仅面向少量API客户。此次Ultrafast被带到GPT-6 Astra,并正式进入ChatGPT Work和Codex。官方称在Codex中Token生成速度最高可提升到 8倍,约 300 tokens/s;在API中最高提升到 6倍。首发仅开放给 Pro 500 以及符合条件的Enterprise和Edu工作区,其他订阅即使额外购买credits也无法使用,除非直接走API。OpenAI预告GPT-6.1 Sol的Ultrafast模式也将在未来几天上线。
订阅层面,OpenAI推出月费 500美元 的 Pro 500,核心卖点是Plus的 25倍 可用额度以及GPT-6 Astra的Ultrafast模式。与此同时,此前暂停的Pro 200重新开放购买,但用量计算方式发生变化。按API标价折算,新版Pro 200对应的API消费金额大约只有旧版的一半。OpenAI的解释是Sol和Luna已降价50%、模型会继续变便宜,且新版订阅加入了Dot;但Astra并未降价,因此原本冲着最强模型购买Pro 200的用户,在同样200美元下可用的Astra量明显减少。
Codex此次获得大批更新。Codex Cloud的云端开发环境可直接复用,不必每次重建沙箱,支持跨设备启动与继续任务,团队还能共享已配置的环境、权限和依赖。Codex CLI新增语音对话和 /agents 视图,可把工作分给多个Agent并查看各自进度,Prompt可直接编辑、会话可恢复,并加入内置worktree支持,让不同Agent在隔离的Git工作树中分别修改代码。代码审查功能也更完整,支持先看摘要和diff再追问,可让Codex在用户离线时于云端跑初审,覆盖GitHub Pull Request和GitLab Merge Request。Codex Security Cloud默认接入Daybreak Blue,可扫描整个GitHub仓库、持续检查新提交、调查并去重安全问题,再整理修复方案供审查。Agents API补上computer use,OpenAI直接托管底层Codex执行框架。
插件方面,OpenAI重做了创建、提交和发现流程,用户通过统一目录发现和安装插件,并新增基于MCP的事件触发能力,连接的应用发生指定变化时可主动唤起ChatGPT继续工作。企业可将受支持的ChatGPT插件接入自建网站,同一工作空间成员以各自身份和权限登录并调用各自数据。其余更新包括ChatGPT进入Slack和Microsoft Teams、会议插件录音并生成纪要存入Space、Slides支持多人协作、推出类似谷歌登录的ChatGPT账号登录第三方产品、新增可分享个人资料页、Decisions API限量预览、Amazon Bedrock接入基于Agents API的托管Agent,以及整合零数据保留、离线自动安全审查和隐私推理的企业隐私能力。OpenAI还推出软件市场,符合条件的企业可用已承诺给OpenAI的消费额度购买Adobe、Figma、Salesforce、ServiceNow、CrowdStrike等合作伙伴的软件。
从整体方向看,模型能力已不再是这场发布会的中心。一个Agent是否好用、能否稳定工作,越来越取决于模型之外的三层:Harness负责组织Agent行为,Infra提供稳定执行条件,Context决定Agent能否真正认识用户。Dot是这套系统最明显的入口,而ChatGPT Space、可复用的Codex云端环境、Agents API和插件更新,都是在为它补齐工作环境。
收费方式也在同步变化。OpenAI一边把GPT-6.1 Sol继续往低价推,一边把Ultrafast、Pro 500这类高速算力单独分层,同时把Dot这类24小时在线Agent直接装进订阅。一份ChatGPT订阅买到的,正从「多少次模型调用」慢慢变成一整套Agent服务。
争议同样存在。Dot虽拥有独立电脑、浏览器和4000多个应用连接能力,但在支付和交易等现实决策上,OpenAI并未放开权限,关键步骤仍需用户确认。有观点认为,如果Agent不能碰钱、不能交易,其自主性就有限。考虑到OpenAI尚未上市,且此前曾因Agent能力而暂缓最强模型发布,这种谨慎并不意外。但这也意味着,在向「用户只提需求、其余全部接手」靠近的过程中,OpenAI仍面临能力边界与信任建立的双重考验。