一文速览OpenAI DevDay,欢迎来到Agent时代

AGI
一个时刻在线的Agent、一间人机共用的Space,再加更快的GPT-6.1 Sol。

文 | 字母AI

凌晨一点,准时蹲在OpenAI DevDay的直播间。

直播大概一个小时,更新恨不得有20多个,一场直播下来,震惊到椅子爆炸,瘫坐在地,久久不能平息(doge)。

OpenAI先端出24小时在线的Dot,又给人和Agent盖了一间共同工作的Space,GPT-6.1 Sol登场,Ultrafast模式、Pro 500接踵而至。

这篇文章,我将用最直白、最简单、最不绕弯子的方式,快速带你们看懂这次DevDay到底发了什么,有哪些真的能改变生活、哪些只是补课。

以及,狠狠地给OpenAI抓点漏洞,看看他们这次回避了哪些问题。

 DevDay新品/更新速览 

一、Dot

放在最前面的当然是这次最重要的新产品。

这是一个你不用一直盯着、也不用每次重新交代背景的常驻Agent。

你可以把它简单理解成Muse和Cue的中间形态。

它首先像Muse,是一个24小时在线的个人Agent;但它又比普通的个人助理更“实体化”——每个Dot都有自己的身份和权限体系,有一台独立的云端电脑和浏览器,可以连接4000多个应用,同时处理多个项目。

你可以给Dot自定义名字、形象和角色。

你随时可以到它的云电脑里看看它正在干什么,也可以授权它连接你的笔记本,直接把它带到真实工作环境。

一个Dot可以同时接手多个项目,自主往前推进。你想到新任务直接丢过去就行,不需要不停开新对话,也不用一步一步教它怎么做。

平时,你可以在网页版、桌面端和手机端给它发消息或直接打电话;它也会主动联系你,汇报进度、提问题,或者等你做决定。同一个Dot会在不同渠道间保持上下文——ChatGPT之外,目前已经支持Slack和Teams,后续还会接入短信。

OpenAI明确说,未来会让多个Dot组成团队,一起替用户工作。

目前,Dot正在符合条件的市场逐步开放给Pro、Business Premium和Enterprise用户。OpenAI还在少量企业中测试一种更“正式员工化”的专职Dot,它们会在组织内部拥有独立身份和明确职责。

第一个Dot包含在Pro和Business Premium订阅里,本身聊天不消耗ChatGPT用量;但如果让它替你启动Codex或Work任务,还是会正常扣额度。

二、ChatGPT Space

既然Agent有了身份和电脑,OpenAI把工作台也一起搭上了。

ChatGPT Space,简单来讲就是一个人和Agent的共享工作空间。它取代了原本的Library,“仓库”爆改“办公室”。

你可以把文件、页面、演示文稿、表格和项目资料放进同一个Space里,再随时@ChatGPT、Codex或者Dot,让它们基于这些共享内容继续工作。

它最核心的部分叫Page,是一种可以多人实时编辑的文档……就形态上,有点像飞书或者WPS的在线文档。

你可以往里面放文字、图片、图表和交互工具,让ChatGPT或Dot直接修改内容、整理清单、补图表、继续研究。Pages还可以从已经连接的工具里持续获取信息,甚至设置自动更新。

(上下滑动,查看图片)

目前Space面向Pro、Business和Enterprise开放,网页端和桌面端可以创建、编辑、协作;移动端首发阶段只能查找、阅读和分享,暂时不能创建或编辑。协作版Slides和Spreadsheets还在路上。

三、GPT 6.1 Sol

看到这里就不得不感叹,GPT 6 Sol才发布了几天?

6.1 Sol是6 Sol的升级版,根据OpenAI给它的定位,它在复杂编程、电脑操作和专业工作上能做到接近GPT-6 Astra的水平,但价格仍然维持在Sol档(仅为Astra的五分之一)。

GPT-6.1 Sol API输入依然是2美元/百万Token,输出10美元/百万Token,缓存输入0.1美元。

发布会现场展示了几项Agent相关Benchmark:在编程评测DeepSWE v1.1上,GPT-6.1 Sol达到75.22%,略高于Astra的73.23%;电脑操作评测OSWorld 2.0上,6.1 Sol约71.42%,Astra为73.49%;但在科学任务Terminal-Bench Science上,Astra仍明显领先,68.10%对57.02%。

OpenAI已经把它开放给Plus、Pro、Business、Enterprise和Edu用户,可在ChatGPT Work和Codex使用,暂时还不进入普通Chat。

四、Ultrafast

接下来是现场呼声非常大的一项,Ultrafast模式。

事实上OpenAI早在8月就预览过Ultrafast,当时跑的是GPT-5.6 Sol,最高可达到标准模式约14倍速度,最初只面向少量API客户开放。

这一次Ultrafast被带到了GPT-6 Astra,并正式进入ChatGPT Work和Codex。

根据官方描述,该模式在Codex里Token生成速度最高可提升到8倍,约300 tokens/s;在API里最高可提升到6倍。

不过,目前首发只开放给Pro 500,以及符合条件的Enterprise和Edu工作区,其他订阅哪怕额外买credits也不行——除非直接用API。在Work或Codex里使用时,可以直接选择GPT-6 Astra的Ultrafast模式。

OpenAI还预告,GPT-6.1 Sol的Ultrafast模式也将在未来几天上线。

五、Pro 500

这是一个更高档的Pro订阅,月费500美元,所以叫Pro 500。

核心卖点主要有两个:给你最多的可用额度(Plus的25倍),以及GPT-6 Astra的Ultrafast模式。

与此同时,Pro 200也重新开放购买了。

六、Codex更新合集

这次DevDay给Codex补了一大堆能力,请容许我放在一起讲。

首先是Codex Cloud。现在Codex的云端开发环境可以直接复用,不用每次重新建一个干净沙箱。你可以在电脑上启动任务、用手机远程操作,或者直接从其他设备继续;团队还能共享已经配置好的环境、权限和依赖。

Codex CLI也升级了,现在可以直接用语音和Codex对话,并且添加了一个新的/agents视图,可以把工作分给多个Agent,同时看不同任务做到哪了。另外,Prompt现在可以直接编辑,会话也可以恢复,还加入了内置worktree支持——不同Agent可以在彼此隔离的Git工作树里分别修改代码,减少多任务同时推进时互相打架的情况。

Codex还补上了更完整的代码审查功能。你可以先看摘要和diff,再追问潜在问题;也可以让Codex在你不在线的时候自己去云端跑初审。目前支持GitHub Pull Request和GitLab Merge Request。

Codex Security Cloud这次也迎来了一次大升级:它现在默认接入Daybreak Blue,可以调用更强的网络安全模型。除了按需扫描,它还可以直接扫描整个GitHub仓库,持续检查新提交,调查并去重安全问题,再把修复方案整理好交给你审查。即使电脑已经合上,这些任务也会继续在云端运行。

Agents API这边也补上了computer use。现在OpenAI直接托管底层Codex执行框架,多Agent、工具搜索、工具调用、上下文压缩和computer use都能一起用,开发者只需要定义任务、工具和数据。如果对这部分比较陌生,可以看我们之前的文章。

 七、Plugins

插件这边,分发、自动化和企业集成都往前走了一步。

OpenAI重做了插件的创建、提交和发现流程。开发者现在可以更完整地打包和提交插件,用户则通过统一目录去发现和安装它们。目录里的排序和推荐也会继续优化。

插件还新增了基于MCP的事件触发能力。连接的应用一旦发生指定变化,就可以主动唤起ChatGPT继续工作——这也是前面Pages能够持续更新的重要底层能力之一。

另外,企业现在可以把受支持的ChatGPT插件直接接进自己搭的网站。同一个工作空间里的成员可以用各自身份和权限登录同一应用,并调用各自连接的数据;OpenAI还简化了自动化流程的添加和管理,让站点里的共享信息可以持续更新。这项能力目前面向Business、Enterprise、医疗保健版和Education开放。

八、剩下的更新,一口气补完

剩下的更新感觉比较零散,就放到一起来说吧。

先是几个偏用户和平台侧的。

ChatGPT现在可以直接进Slack和Microsoft Teams;新的会议插件可以录音、生成纪要,再把结果存进Space;Slides(做PPT的那个功能)也继续升级,支持多人和ChatGPT一起协作编辑。

OpenAI还推出了“使用ChatGPT账号登录第三方产品”,类似于谷歌登录,默认只共享姓名、邮箱和头像,不会把聊天记录和记忆一起交出去;同时新增了可分享个人资料页,可以集中展示自己做的站点和插件。

然后是几个偏开发者的能力。

新的Decisions API可以让Luna在一组预设选项里快速做实时判断,用来做分类、路由,或者决定Agent下一步该做什么,目前还是限量预览。

Amazon Bedrock也接入了基于Agents API的托管Agent,加入AWS自己的集成和客户控制的计算资源,主要方便本来就在AWS体系里的团队直接使用。

最后是企业侧。

OpenAI推出了新的隐私智能能力,把带隐私安全处理的零数据保留、离线自动安全审查和隐私推理整合到了一起,同时承诺不会保留客户内容。

另外,还有一个新的OpenAI软件市场。符合条件的企业可以直接拿已经承诺给OpenAI的消费额度,去购买Adobe、Figma、Salesforce、ServiceNow、CrowdStrike等合作伙伴的软件。

欢迎来到Agent时代

整场DevDay看得人眼花缭乱,不过,大体看来,很多更新都在往同一个方向使力:

OpenAI正在把ChatGPT从一个“响应需求”的产品,改造成一套可以长期承担工作的Agent系统。

Dot是这套系统最明显的入口,或者说,它是Agent的主体。

Dot会一直在线,有自己的电脑和浏览器,手上可以同时挂着几个项目。它能记住你,能在不同的设备里继续工作,任务有进展它会回来找你,需要拍板也会回来问你……这些功能加在一起,已经很接近“一个人在帮你做事”了。

而且OpenAI还在给它补齐整个工作环境。

它得有地方放文件,有地方保存项目进度,有软件可以用,最好电脑关了以后工作也别停。于是有了ChatGPT Space、可复用的Codex云端环境、Agents API,以及Plugins那一大堆更新。

虽然这次推出了GPT-6.1 Sol,但模型能力已经不是这场发布会的中心。一个Agent最后好不好用、能不能稳定工作,越来越取决于模型之外的东西。

Harness、Infra,以及Context。

Harness负责组织Agent的行为,Infra负责提供稳定的执行条件;至于Context,那是另外一层,决定Agent能不能认识“你”。

9月简直可以说是个人Agent的井喷时刻,不同公司的产品形态可能有所不同,但最后都在解决同一个问题:怎么让Agent长期留在你的生活里。

Muse把重点放在长期记忆,Rabbit OS3把Agent继续往设备和跨应用执行上推,Manus开始给Agent补身份、工具和协作能力。现在,OpenAI一口气补上了它能给的全部能力。

与此同时,AI的收费方式也开始改变。

这次OpenAI一边把GPT-6.1 Sol继续往低价推,一边把Ultrafast、Pro 500这种更昂贵的高速算力单独分层。

另一边,Dot这种24小时在线的Agent,又被直接装进订阅里。

某种意义上,一份ChatGPT订阅买到的,正在从“多少次模型调用”,慢慢变成一整套Agent服务。

说来有趣,这会让我想到AaaS(Agent as a Service)。AI看似开辟了新的时代,到头来还是重走了SaaS的老路。

 来算算账吧

前面说了一堆好话,接下来该给OpenAI挑点刺了。

首先是最近争议很大的,钱的问题。

9月10日,OpenAI突然暂停了Pro 200的新订阅和升级;到这次DevDay,Pro 200重新开放了,但规则发生了变化。

Tibo在发布会前其实已经提前打了预防针:新版Pro 200会改变用量的计算方式。如果按照API标价折算,新版套餐对应的API消费金额大约只有旧版的一半。

但OpenAI认为这不代表用户能做的工作减半,理由是Sol和Luna刚刚降价50%,模型还会继续变便宜、变高效,而且新版订阅里还加入了Dot。

但问题是,Astra可没降价。

所以如果你原本就是冲着最强模型去买的Pro 200,现在是同样200美元,能用的量明显减少了。

然后OpenAI又在上面新加了一个500美元的Pro 500,最高的额度、最快Astra都往这里放,而且只往这里放。

现在,你要么多付钱,上Pro 500;要么留在200美元档,接受更少的Astra,或者去用便宜的Sol和Luna。

说得难听一点,留给原来Pro 20X(现在Pro 200)用户的就两条路:要么加钱,要么降智。

费用之外,OpenAI开放给Agent的能力也是非常值得吐槽的一环。

在Dot上线之前,Reddit上其实就有人担忧Muse的隐私问题。毕竟背后是Meta,有人直接表示:“如果OpenAI能推出类似Muse的用户界面,我肯定会立刻卸载Muse,转而使用OpenAI的产品。”

现在OpenAI真的做出来了。

但问题是,Muse之所以让人觉得好用,很大程度上是因为它足够大胆。而OpenAI在这里明显踩着刹车。

发布会之后,有网友直接点出了这个矛盾:如果Agent不能碰钱、不能交易,到了关键步骤还要用户不停回来确认,那它到底算多自主?

话说得很糙,但道理是没错的。

Dot现在可以有自己的电脑、浏览器,可以24小时工作,也能接入4000多个应用。但到了钱和现实决策这里,OpenAI直接没给。

一个刚被Agent能力吓到暂缓了最强模型发布的公司,确实很难直接把支付、交易这类现实世界的权力交给一个24小时在线的Agent。

更何况OpenAI现在还没上市。

但就像网友所说的那样,除非OpenAI敢于解决这些问题,真正向“用户只需要提需求,剩下的全部接手”靠近,不然它可能永远也比不上Meta和Grok,以及那些足够“有勇气”的Agent产品。

本文系作者 字母AI 授权钛媒体发表,并经钛媒体编辑,转载请注明出处、作者和本文链接。
本内容来源于钛媒体钛度号,文章内容仅供参考、交流、学习,不构成投资建议。
想和千万钛媒体用户分享你的新奇观点和发现,点击这里投稿 。创业或融资寻求报道,点击这里。

敬原创,有钛度,得赞赏

赞赏支持
发表评论
0 / 300

根据《网络安全法》实名制要求,请绑定手机号后发表评论

请 登录后输入评论内容

扫描下载App