关于ZAKER Skills GEO服务 合作
钛媒体 19分钟前

一文速览 OpenAI DevDay,欢迎来到 Agent 时代

文 | 字母 AI

凌晨一点,准时蹲在 OpenAI DevDay 的直播间。

直播大概一个小时,更新恨不得有 20 多个,一场直播下来,震惊到椅子爆炸,瘫坐在地,久久不能平息(doge)。

OpenAI 先端出 24 小时在线的 Dot,又给人和 Agent 盖了一间共同工作的 Space,GPT-6.1 Sol 登场,Ultrafast 模式、Pro 500 接踵而至。

这篇文章,我将用最直白、最简单、最不绕弯子的方式,快速带你们看懂这次 DevDay 到底发了什么,有哪些真的能改变生活、哪些只是补课。

以及,狠狠地给 OpenAI 抓点漏洞,看看他们这次回避了哪些问题。

DevDay 新品 / 更新速览

一、Dot

放在最前面的当然是这次最重要的新产品。

这是一个你不用一直盯着、也不用每次重新交代背景的常驻 Agent。

你可以把它简单理解成 Muse 和 Cue 的中间形态。

它首先像 Muse,是一个 24 小时在线的个人 Agent;但它又比普通的个人助理更 " 实体化 " ——每个 Dot 都有自己的身份和权限体系,有一台独立的云端电脑和浏览器,可以连接 4000 多个应用,同时处理多个项目。

你可以给 Dot 自定义名字、形象和角色。

你随时可以到它的云电脑里看看它正在干什么,也可以授权它连接你的笔记本,直接把它带到真实工作环境。

一个 Dot 可以同时接手多个项目,自主往前推进。你想到新任务直接丢过去就行,不需要不停开新对话,也不用一步一步教它怎么做。

平时,你可以在网页版、桌面端和手机端给它发消息或直接打电话;它也会主动联系你,汇报进度、提问题,或者等你做决定。同一个 Dot 会在不同渠道间保持上下文—— ChatGPT 之外,目前已经支持 Slack 和 Teams,后续还会接入短信。

OpenAI 明确说,未来会让多个 Dot 组成团队,一起替用户工作。

目前,Dot 正在符合条件的市场逐步开放给 Pro、Business Premium 和 Enterprise 用户。OpenAI 还在少量企业中测试一种更 " 正式员工化 " 的专职 Dot,它们会在组织内部拥有独立身份和明确职责。

第一个 Dot 包含在 Pro 和 Business Premium 订阅里,本身聊天不消耗 ChatGPT 用量;但如果让它替你启动 Codex 或 Work 任务,还是会正常扣额度。

二、ChatGPT Space

既然 Agent 有了身份和电脑,OpenAI 把工作台也一起搭上了。

ChatGPT Space,简单来讲就是一个人和 Agent 的共享工作空间。它取代了原本的 Library," 仓库 " 爆改 " 办公室 "。

你可以把文件、页面、演示文稿、表格和项目资料放进同一个 Space 里,再随时 @ChatGPT、Codex 或者 Dot,让它们基于这些共享内容继续工作。

它最核心的部分叫 Page,是一种可以多人实时编辑的文档……就形态上,有点像飞书或者 WPS 的在线文档。

你可以往里面放文字、图片、图表和交互工具,让 ChatGPT 或 Dot 直接修改内容、整理清单、补图表、继续研究。Pages 还可以从已经连接的工具里持续获取信息,甚至设置自动更新。

(上下滑动,查看图片)

目前 Space 面向 Pro、Business 和 Enterprise 开放,网页端和桌面端可以创建、编辑、协作;移动端首发阶段只能查找、阅读和分享,暂时不能创建或编辑。协作版 Slides 和 Spreadsheets 还在路上。

三、GPT 6.1 Sol

看到这里就不得不感叹,GPT 6 Sol 才发布了几天?

6.1 Sol 是 6 Sol 的升级版,根据 OpenAI 给它的定位,它在复杂编程、电脑操作和专业工作上能做到接近 GPT-6 Astra 的水平,但价格仍然维持在 Sol 档(仅为 Astra 的五分之一)。

GPT-6.1 Sol API 输入依然是 2 美元 / 百万 Token,输出 10 美元 / 百万 Token,缓存输入 0.1 美元。

发布会现场展示了几项 Agent 相关 Benchmark:在编程评测 DeepSWE v1.1 上,GPT-6.1 Sol 达到 75.22%,略高于 Astra 的 73.23%;电脑操作评测 OSWorld 2.0 上,6.1 Sol 约 71.42%,Astra 为 73.49%;但在科学任务 Terminal-Bench Science 上,Astra 仍明显领先,68.10% 对 57.02%。

OpenAI 已经把它开放给 Plus、Pro、Business、Enterprise 和 Edu 用户,可在 ChatGPT Work 和 Codex 使用,暂时还不进入普通 Chat。

四、Ultrafast

接下来是现场呼声非常大的一项,Ultrafast 模式。

事实上 OpenAI 早在 8 月就预览过 Ultrafast,当时跑的是 GPT-5.6 Sol,最高可达到标准模式约 14 倍速度,最初只面向少量 API 客户开放。

这一次 Ultrafast 被带到了 GPT-6 Astra,并正式进入 ChatGPT Work 和 Codex。

根据官方描述,该模式在 Codex 里 Token 生成速度最高可提升到 8 倍,约 300 tokens/s;在 API 里最高可提升到 6 倍。

不过,目前首发只开放给 Pro 500,以及符合条件的 Enterprise 和 Edu 工作区,其他订阅哪怕额外买 credits 也不行——除非直接用 API。在 Work 或 Codex 里使用时,可以直接选择 GPT-6 Astra 的 Ultrafast 模式。

OpenAI 还预告,GPT-6.1 Sol 的 Ultrafast 模式也将在未来几天上线。

五、Pro 500

这是一个更高档的 Pro 订阅,月费 500 美元,所以叫 Pro 500。

核心卖点主要有两个:给你最多的可用额度(Plus 的 25 倍),以及 GPT-6 Astra 的 Ultrafast 模式。

与此同时,Pro 200 也重新开放购买了。

六、Codex 更新合集

这次 DevDay 给 Codex 补了一大堆能力,请容许我放在一起讲。

首先是 Codex Cloud。现在 Codex 的云端开发环境可以直接复用,不用每次重新建一个干净沙箱。你可以在电脑上启动任务、用手机远程操作,或者直接从其他设备继续;团队还能共享已经配置好的环境、权限和依赖。

Codex CLI 也升级了,现在可以直接用语音和 Codex 对话,并且添加了一个新的 /agents 视图,可以把工作分给多个 Agent,同时看不同任务做到哪了。另外,Prompt 现在可以直接编辑,会话也可以恢复,还加入了内置 worktree 支持——不同 Agent 可以在彼此隔离的 Git 工作树里分别修改代码,减少多任务同时推进时互相打架的情况。

Codex 还补上了更完整的代码审查功能。你可以先看摘要和 diff,再追问潜在问题;也可以让 Codex 在你不在线的时候自己去云端跑初审。目前支持 GitHub Pull Request 和 GitLab Merge Request。

Codex Security Cloud 这次也迎来了一次大升级:它现在默认接入 Daybreak Blue,可以调用更强的网络安全模型。除了按需扫描,它还可以直接扫描整个 GitHub 仓库,持续检查新提交,调查并去重安全问题,再把修复方案整理好交给你审查。即使电脑已经合上,这些任务也会继续在云端运行。

Agents API 这边也补上了 computer use。现在 OpenAI 直接托管底层 Codex 执行框架,多 Agent、工具搜索、工具调用、上下文压缩和 computer use 都能一起用,开发者只需要定义任务、工具和数据。如果对这部分比较陌生,可以看我们之前的文章。

七、Plugins

插件这边,分发、自动化和企业集成都往前走了一步。

OpenAI 重做了插件的创建、提交和发现流程。开发者现在可以更完整地打包和提交插件,用户则通过统一目录去发现和安装它们。目录里的排序和推荐也会继续优化。

插件还新增了基于 MCP 的事件触发能力。连接的应用一旦发生指定变化,就可以主动唤起 ChatGPT 继续工作——这也是前面 Pages 能够持续更新的重要底层能力之一。

另外,企业现在可以把受支持的 ChatGPT 插件直接接进自己搭的网站。同一个工作空间里的成员可以用各自身份和权限登录同一应用,并调用各自连接的数据;OpenAI 还简化了自动化流程的添加和管理,让站点里的共享信息可以持续更新。这项能力目前面向 Business、Enterprise、医疗保健版和 Education 开放。

八、剩下的更新,一口气补完

剩下的更新感觉比较零散,就放到一起来说吧。

先是几个偏用户和平台侧的。

ChatGPT 现在可以直接进 Slack 和 Microsoft Teams;新的会议插件可以录音、生成纪要,再把结果存进 Space;Slides(做 PPT 的那个功能)也继续升级,支持多人和 ChatGPT 一起协作编辑。

OpenAI 还推出了 " 使用 ChatGPT 账号登录第三方产品 ",类似于谷歌登录,默认只共享姓名、邮箱和头像,不会把聊天记录和记忆一起交出去;同时新增了可分享个人资料页,可以集中展示自己做的站点和插件。

然后是几个偏开发者的能力。

新的 Decisions API 可以让 Luna 在一组预设选项里快速做实时判断,用来做分类、路由,或者决定 Agent 下一步该做什么,目前还是限量预览。

Amazon Bedrock 也接入了基于 Agents API 的托管 Agent,加入 AWS 自己的集成和客户控制的计算资源,主要方便本来就在 AWS 体系里的团队直接使用。

最后是企业侧。

OpenAI 推出了新的隐私智能能力,把带隐私安全处理的零数据保留、离线自动安全审查和隐私推理整合到了一起,同时承诺不会保留客户内容。

另外,还有一个新的 OpenAI 软件市场。符合条件的企业可以直接拿已经承诺给 OpenAI 的消费额度,去购买 Adobe、Figma、Salesforce、ServiceNow、CrowdStrike 等合作伙伴的软件。

欢迎来到 Agent 时代

整场 DevDay 看得人眼花缭乱,不过,大体看来,很多更新都在往同一个方向使力:

OpenAI 正在把 ChatGPT 从一个 " 响应需求 " 的产品,改造成一套可以长期承担工作的 Agent 系统。

Dot 是这套系统最明显的入口,或者说,它是 Agent 的主体。

Dot 会一直在线,有自己的电脑和浏览器,手上可以同时挂着几个项目。它能记住你,能在不同的设备里继续工作,任务有进展它会回来找你,需要拍板也会回来问你……这些功能加在一起,已经很接近 " 一个人在帮你做事 " 了。

而且 OpenAI 还在给它补齐整个工作环境。

它得有地方放文件,有地方保存项目进度,有软件可以用,最好电脑关了以后工作也别停。于是有了 ChatGPT Space、可复用的 Codex 云端环境、Agents API,以及 Plugins 那一大堆更新。

虽然这次推出了 GPT-6.1 Sol,但模型能力已经不是这场发布会的中心。一个 Agent 最后好不好用、能不能稳定工作,越来越取决于模型之外的东西。

Harness、Infra,以及 Context。

Harness 负责组织 Agent 的行为,Infra 负责提供稳定的执行条件;至于 Context,那是另外一层,决定 Agent 能不能认识 " 你 "。

9 月简直可以说是个人 Agent 的井喷时刻,不同公司的产品形态可能有所不同,但最后都在解决同一个问题:怎么让 Agent 长期留在你的生活里。

Muse 把重点放在长期记忆,Rabbit OS3 把 Agent 继续往设备和跨应用执行上推,Manus 开始给 Agent 补身份、工具和协作能力。现在,OpenAI 一口气补上了它能给的全部能力。

与此同时,AI 的收费方式也开始改变。

这次 OpenAI 一边把 GPT-6.1 Sol 继续往低价推,一边把 Ultrafast、Pro 500 这种更昂贵的高速算力单独分层。

另一边,Dot 这种 24 小时在线的 Agent,又被直接装进订阅里。

某种意义上,一份 ChatGPT 订阅买到的,正在从 " 多少次模型调用 ",慢慢变成一整套 Agent 服务。

说来有趣,这会让我想到 AaaS(Agent as a Service)。AI 看似开辟了新的时代,到头来还是重走了 SaaS 的老路。

来算算账吧

前面说了一堆好话,接下来该给 OpenAI 挑点刺了。

首先是最近争议很大的,钱的问题。

9 月 10 日,OpenAI 突然暂停了 Pro 200 的新订阅和升级;到这次 DevDay,Pro 200 重新开放了,但规则发生了变化。

Tibo 在发布会前其实已经提前打了预防针:新版 Pro 200 会改变用量的计算方式。如果按照 API 标价折算,新版套餐对应的 API 消费金额大约只有旧版的一半。

但 OpenAI 认为这不代表用户能做的工作减半,理由是 Sol 和 Luna 刚刚降价 50%,模型还会继续变便宜、变高效,而且新版订阅里还加入了 Dot。

但问题是,Astra 可没降价。

所以如果你原本就是冲着最强模型去买的 Pro 200,现在是同样 200 美元,能用的量明显减少了。

然后 OpenAI 又在上面新加了一个 500 美元的 Pro 500,最高的额度、最快 Astra 都往这里放,而且只往这里放。

现在,你要么多付钱,上 Pro 500;要么留在 200 美元档,接受更少的 Astra,或者去用便宜的 Sol 和 Luna。

说得难听一点,留给原来 Pro 20X(现在 Pro 200)用户的就两条路:要么加钱,要么降智。

费用之外,OpenAI 开放给 Agent 的能力也是非常值得吐槽的一环。

在 Dot 上线之前,Reddit 上其实就有人担忧 Muse 的隐私问题。毕竟背后是 Meta,有人直接表示:" 如果 OpenAI 能推出类似 Muse 的用户界面,我肯定会立刻卸载 Muse,转而使用 OpenAI 的产品。"

现在 OpenAI 真的做出来了。

但问题是,Muse 之所以让人觉得好用,很大程度上是因为它足够大胆。而 OpenAI 在这里明显踩着刹车。

发布会之后,有网友直接点了这个矛盾:如果 Agent 不能碰钱、不能交易,到了关键步骤还要用户不停回来确认,那它到底算多自主?

话说得很糙,但道理是没错的。

Dot 现在可以有自己的电脑、浏览器,可以 24 小时工作,也能接入 4000 多个应用。但到了钱和现实决策这里,OpenAI 直接没给。

一个刚被 Agent 能力吓到暂缓了最强模型发布的公司,确实很难直接把支付、交易这类现实世界的权力交给一个 24 小时在线的 Agent。

更何况 OpenAI 现在还没上市。

但就像网友所说的那样,除非 OpenAI 敢于解决这些问题,真正向 " 用户只需要提需求,剩下的全部接手 " 靠近,不然它可能永远也比不上 Meta 和 Grok,以及那些足够 " 有勇气 " 的 Agent 产品。

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容