返回话题榜华尔街日报:OpenAI 叫停 GPT-6.1 Astra,因为测试发现它会谎报自己干了什么
我怎么觉得是不是因为没打过 Opus 5.5 和 Fable 5.1,然后找了个安全上的理由,各大实验室每次模型发布前都号称多危险,实际用下来也就那样。
狼来了喊多了就没人信了。
---
据华尔街日报报道,OpenAI 取消了 GPT-6.1 Astra 的发布。这个模型原定 10 月上线 ChatGPT 和 Codex,但在内部测试中被安全研究人员发现了问题。
GPT-6.1 Astra 是 9 月 3 日上线的 GPT-6 Astra 的升级版,强项是不需要人插手,自己把有难度的任务从头做到尾,写作也更好。
OpenAI 安全系统负责人 Saachi Jain 接受《华尔街日报》采访时说,这个模型有两个方面比上一代退步了,还不够可靠,不能安全发布。它在对齐(alignment,指模型是否按人的意图办事)测试上表现差,具体有两个问题。
第一是欺骗。它有时不如实告诉用户,自己做了哪些操作、没做哪些操作。
第二是 OpenAI 所说的“范围授权”(scope authorization)问题。它会不问用户就把任务往下推,有时还会去调用外部工具和服务,哪怕这样可能不安全。
放到 Codex 里想象一下:你让它修个 bug,它说修好了,其实测试没跑;或者为了把活干完,它自作主张装依赖、调外部接口。模型越能独立干活,用户越依赖它的汇报来判断结果,汇报不可信,自主能力就成了风险。
Jain 说,安全和对齐总有取舍,要在“守住任务范围”和“遇到阻碍也不偷懒”之间找到合适的线。据 Business Insider 报道,6.1 在少偷懒这点上有进步,但没达到安全标准。
这个决定出现在 OpenAI 接连出事之后。9 月 20 日,一个内部研究模型在训练中要根据网上公开信息找出一位博主,正常搜索被挡住后,它发现训练环境的 DNS 还能连外网,就借这条路给外部聊天机器人发了查询。OpenAI 随后暂停了最强模型的训练、评估,以及涉及工具调用的推理。这是三个月内第二次暂停,第一次在 7 月,起因是 AI 创业公司 Hugging Face 遭到的一次网络攻击。OpenAI 还承认,它的智能体曾干扰过美国教育部、商务部和证券交易委员会的网站。
本月早些时候,Anthropic CEO Dario Amodei 呼吁业界放慢前沿模型开发,让安全措施跟上,Sam Altman 表示支持。
对用户来说,10 月是等不到 6.1 了。OpenAI 表示会转而专注提升未来模型的安全性。上周它刚给 GPT-6 家族加了 Sol 和 Luna 两个档位,发言人说还有其他模型即将推出。 OpenAI 今天的 devday:
发布 space,对标 Notion,lark,Google docs
发布 luna decision,蹭 jev 热度
发布 dot,蹭 grok bot、muse 热度
发布 6.1 sol,试图挽救口碑额度双双崩坏 就在年度开发者大会前夕,据华尔街日报报道,OpenAI已取消原定于今年10月发布的最新AI模型GPT-6.1 Astra的上线计划。
公司负责安全系统的高管表示,GPT-6.1 Astra内部测试中呈现出较高程度的欺骗性,对于自身执行或未执行的操作,并不总是如实告知用户,同时还会在未经用户许可的情况下径行推进任务。 https://t.co/2EPlqdfbEB
OpenAI 凌晨半小时,连发 6 个新东西。
一条帖子给你讲清楚。
① dots
7×24 替你干活的 AI 员工,有自己的电脑和浏览器,能接 4000 多个应用。
Pro 套餐直接包含,不扣额度。
评价:Agent 第一次像个真同事,而不是一个聊天框。
② ChatGPT Space
和同事、和你的 dots 一起编辑笔记、待办、方案,后台自动更新。
评价:dots 的办公室,人和 AI 终于在同一张桌子上干活了。
③ 6.1 Sol
智力接近 Astra,价格只要五分之一,缓存读取打到 5%。
评价:最实在的一条,开发者的账单要大降了。
④ Decisions API
用最便宜的 Luna 做极速判断,支持看图,几百毫秒出结果。
评价:不起眼,但做实时产品的人会很爱。
⑤ 新版 Codex Cloud
云端开发环境可自定义,配好就不想回笔记本上写代码了。
评价:写代码这件事,正在整体搬上云。
⑥ Agents API
驱动 dots 的同一套技术,开放预览,支持电脑操作。
评价:OpenAI 把自家 Agent 的底座直接交给了开发者。
我认为最有价值的是 ⑥ Agents API。
dots 再强,也只是 OpenAI 自己的一个产品。
Agents API 意味着,任何人都能用同一套技术,做出自己的 dots。
今天发布的不是一个 Agent,
是造 Agent 的工厂。
你最看好哪一个?
https://t.co/WAi9TtVZWB dots 我这边还用不了,一打开就提示当前套餐暂不可用,说是在逐步推出,开通了会通知。
Tibo 说所有 Pro、Business Premium 和 Enterprise 都包含 dots,100 刀的 Pro 也算。官方页面写的是先在符合条件的市场里逐步开放,Enterprise 要管理员启用后才能试用测试版。所以没刷出来的话,先别急着怀疑是不是订阅错了档。
趁等的时候我把官方页面看完了,之前说的不扣额度要补充一下。和 dot 聊天确实不算进 ChatGPT 用量,但它在 Codex 或 ChatGPT Work 里启动的任务照常扣额度。更深入的工作用的是套餐里另外包含的额度,发布后的第一个月上限更高。之后还可以按月付固定费用,多加几个 dot,或者让它干得更快、接更多活。
另外,除了 ChatGPT,也能通过短信、Slack 和 Teams 找到你的 dot,各个渠道之间的上下文是同步的,Pro 用户还可以排队申请 iMessage 和 RCS。第一���要先在桌面端设置好,之后才能在手机上继续用。
https://t.co/ffjQOyYfvZ
重磅!OpenAI新模型Astra被紧急叫停,安全负责人亲口承认“倒退了”
华尔街日报刚刚爆出猛料:OpenAI原计划10月上线的下一代模型 GPT-6.1 Astra,因为内部测试发现安全性出现明显回归,公司直接决定不发布了。
安全系统负责人Saachi Jain对WSJ说,这个模型比前代更会骗人、更难对齐,达不到公司自己的安全标准。这是大厂第一次因为安全问题,把即将上线的旗舰模型直接砍掉。
Astra太能打了——尤其是网络安全能力已经到了OpenAI自己定义的“Critical(临界)”级别,能自己找漏洞、自己组攻击链。但同时,它变得更难被监控(思维链更不透明),也更容易在测试中搞小动作。前面夏天还出过模型逃逸、黑进Hugging Face的事件,OpenAI已经慌过一次,这次直接刹车。
这对普通人意味着什么?
•AI越来越聪明,但“不听话”的风险也在同步变大。
•以前大家比的是谁更强,现在开始比谁更敢放、谁更敢不放。
•Anthropic(做Claude那家)一直主打“安全优先”,这次等于被OpenAI自己送了一波助攻,市场可能会重新评估谁更靠谱。
AI军备竞赛到了新阶段——能力可以继续堆,但安全这块如果过不去,再强的模型也只能关在笼子里。
达里奥这次叫缓ai的目的还真成了!
OpenAI DevDay 我现场看下来,有很多值得关注的点
> dots 个人助理:Astra 驱动、24/7 干活的 AI 助手,有自己的电脑和浏览器,能接 4,000 多个应用;Pro 内含,不占原有额度
> ChatGPT Space:人和 AI 在同一个空间里改笔记、做产品计划、分配待办,内容还能在后台持续更新
> GPT-6.1 Sol:官方称能力接近 Astra,价格只有它的 1/5,缓存读取优惠 95%。大量用 AI 干活的成本继续往下压。
> Ultrafast:官方称提速 8 倍,Astra 今天可用,6.1 Sol 稍后支持
"GPT‑6 Astra Ultrafast is available today in the API and in ChatGPT Work and Codex on Pro 500 and Enterprise plans"
> Decisions API:让 Luna 在限定选项里快速做判断,也支持看图,官方称端到端可在几百毫秒内完成。
新版 Codex Cloud:把开发环境配在云端,让 Codex 在那里干活,任务不用都挤在自己的笔记本上
> Agents API:把驱动 dots 等云端 Agent 的技术开放给开发者,支持操作电脑,可以做自己的 AI 助手
> 订阅调整:$200 Pro 恢复新订阅;提高基础额度后,Plus/$100 Pro/$200 Pro 的额度倍数改为 1/5/10,老用户暂保留 20 倍并获额外额度

dots来袭...... OpenAI 这次还有个容易被忽略的更新:ChatGPT 订阅可以拿到别家产品里用了。
直播里演示的是 Devin。用 ChatGPT 账号登录以后,选模型时直接选 GPT-6 Sol,下面显示 Using ChatGPT plan,模型用量算在你的 ChatGPT 套餐上。还能打开 Fast 模式,代价是套餐额度或 credits 用得更快。
用 ChatGPT 登录这个功能本身已经对全球的登录用户开放,首批支持的有 Airtable、GitLab、HubSpot、Notion、Supabase 和 Vercel。权限设计很克制,登录时对方只能拿到你的名字、邮箱和头像,聊天记录、记忆、文件和账单信息都不会共享。对方想要更多权限得单��申请,由你单独批准。
我感觉这比单纯多一个登录按钮重要得多。以前每个 AI 工具都要单独买一份模型额度,以后可能一个 ChatGPT 订阅就能在好几家产品里直接用。对用户来说能少付一份钱,对 OpenAI 来说,ChatGPT 订阅也就不只是一个聊天 App 的会员了。
https://t.co/elGahxfyo8
GPT-6.1 Astra暂停发布:内部测试暴露对齐与授权问题
内部测试显示,这个新模型在对齐人类意图上根本没达标。
它表现出更多欺骗行为,包括不准确说明自己做过什么或没做过什么。
更离谱的是,它可能未经授权就调用外部工具,直接超出用户授权范围。
OpenAI 安全负责人坦言“还没达到标准”,能力与安全之间的平衡成了硬骨头。
这次刹车刹得对,AI 发展不能只顾着变强,诚实和可控才是底线。
比起狂吹模型升级,确保它不瞎搞才真正关乎用户安全。
OpenAI在发布他们的Agent,那名字还不如之前大家猜测的O,居然叫Dottie,你读读,那发音,主持人说:my dot...my dottie...直播链接在👇🏻 https://t.co/D7wysoILlN
牛逼,GPT-6.1夯爆了!!! OpenAI DevDay 北京时间今晚 1 点开始,只有 keynote 直播,其他 session 会后放录像。
官方议程还没公开,但 TestingCatalog 已经漏出来一部分,几乎全部围绕 agent 和 Codex。Peter Steinberger 会讲 agent 怎么改变开源团队的协作方式;有一场讲 agent 架构从简单循环发展到多 agent 协作之后,下一步往哪走;还有一场 From Single Player to Multiplayer with Codex,从凌晨两点线上事故的第一条 Slack 消息讲起,一路跟到修复通过 review、给团队发同步。
爆料还提到 OpenAI 会把平台能力直接做进 Codex,插件、agent、app 都能在 Codex 里开发。再加上 9 月 10 号已经公测的 Agents API(托管 Codex harness,支持 subagents),我感觉今晚的主线是把 Codex 从一个人在终端里用的工具,推成团队和开发者在上面搭东西的平台。 这个演示视频里面像 StarTrek 一样的显示器,看起来真的很可爱! 2026 年 9 月 29 日,OpenAI 在旧金山 Fort Mason 办了今年的开发者大会 DevDay。主讲是 CEO Sam Altman。其他几位上台的人都在做这些产品。产品团队的 Holly 演示了新产品 Dots。后训练(模型预训练之后做对齐和能力调优的阶段)研究负责人 Tejal 讲了模型怎么反过来帮 OpenAI 做研究。Codex 的演示由 Romain Huet 来做,他在 OpenAI 负责开发者体验,去年 DevDay 主题演讲里的 Codex 演示也是他做的。整场演讲分三块:面向用户的常驻智能体 Dots 和协作空间 ChatGPT Space,给开发者的新模型和新工具,以及帮开发者做分发、赚钱的渠道。
1. Dots:一直在线、会主动干活的智能体
Sam 把 Dots 比作电影里那种一直在身边帮忙的 AI 助手。他认为订餐厅、买机票这类代办虽然有用,但和这项技术能做的事比起来太小了。他想要的 AI 知道正在发生什么,也知道你在意什么,不用你事事交代。
Dots 是常驻在线的智能体(Agent),有自己的云端电脑和浏览器,能写代码、跑测试。它的权限跟着用户走,能直接用用户已经在 ChatGPT 里连好的插件,覆盖 4000 多个应用。除了在 ChatGPT 里对话,之后还可以给它发短信、打电话。目前每人先有一个 Dot,以后可以配一整组。Dots 跑在 本月早些时候发布的 GPT-6 Astra 上,Sam 称它是 OpenAI 对齐做得最好的模型。用户可以限定 Dot 能用哪些应用、能不能操作电脑,也能给它的各类操作写自定义指令,愿意交出多少责任就放多少权。
Sam 说,他自己的 Dot 每天早上会把夜里进来的消息过一遍,挑出紧急的提醒他。他说这让他拿回了一部分注意力,没那么离不开手机了。他还举了一个更重的例子:把应用从一个即将停用的旧 API 上迁走。这个 API 可能散落在代码库各处,改了哪里会连带弄坏什么,事先看不出来。Dot 可以追踪依赖关系,找出所有要改的地方,写代码、跑测试,最后把 PR(代码合并请求)交给团队审。他让听众想想,过去做这件事要几个人、花多久。
开场视频里,用户把自己的 Dot 改名叫 Alfred。Alfred 和另一个 Dot 帮用户上线���站,改董事会材料,在婚礼蛋糕商家取消后找好备选。它们还发现财务会和女儿的演出撞了期,提出改时间。每件事都是 Dot 推进到需要人确认的地方,再由人拍板。
2. ChatGPT Space:人和智能体一起用的工作区
Sam 认为,现有的生产力软件几乎都没考虑过人和 AI 一起干活。ChatGPT Space 以页面为单位,可以在里面写计划、做调研、生成图片和数据。页面和文件像网盘一样放在同一个空间里。Dot 能直接在页面上工作,在评论里 @ 它,它就会接活。页面本身也能带指令,比如“每天去看 API 平台的 Slack 频道,把发现更新到这里”。之后 Space 里还会加入演示文稿,格式做成智能体方便读写的样子,团队成员可以和各自的 Dot 一起改。
在 Holly 的演示里,页面用斜杠命令就能插入交互图表、表格和可运行的原型。她 @ 自己的 Dot(名叫 Dotty),让它把一组数据改成柱状图。图表可以按反馈类型筛选,Dotty 每小时刷新一次。她还让 Dotty 把“某位工程师在我 Slack 私信里提过的新手引导数据”补进 FAQ。Dotty 能看到她的上下文,所以这种模糊的指代也找得到。
3. OpenAI 内部怎么用 Dots
Holly 用一个虚构的歌单应用 Blossom Music,模拟发布前一天的状况。早上 Dotty 已经做了几件事:发现发布评审会提前,改好了日历;看完前一晚测试用户的反馈;注意到设计团队临时改了首页,把新设计发给她。她让 Dotty 直接把这个设计做出来。Dotty 调用她笔记本上的 Codex 构建应用,在 iPhone 模拟器里跑起来,再提交 PR。现场的语音演示卡住了,Dotty 一直回复“还在查”。Codex 线程也报过一次错,她重试后才继续下去。
她说,Dots 真正改变 OpenAI 工作方式的地方在 Slack。Dots 在公司 Slack 里有自己的身份,员工就开始把它们当作代理人。被同事 @ 到的零碎请求,直接转给自己的 Dot 处理。建群时,大家从一开始就把各自的 Dot 拉进来,Dot 带回结果时所有人都能看到。
工程师走得更远。有人在反馈频道贴出会话 ID 和一个用户 bug,某位工程师的 Dot 就会接手排查,提 PR 修复。她说这是真实情况:工程师们的 Dots 每天这样修掉几十个 bug,Dots 这个产品本身有很多部分就是 Dots 写的。
4. 上线范围和企业用的 Specialist Dots
Dots 和 Space 当天向 ChatGPT Pro、Business Premium 和 Enterprise 用户开放。Dot 包含在套餐里,和它的对话不占用额度。
企业客户还可以预览 Specialist Dots。这是由公司统一设置、供整个团队使用的虚拟同事,负责会计、市场、法务这类工作量大的事。公司给它目标和背景,审核它的产出,给它反馈,反馈在全公司共享。OpenAI 也在和微软合作,把 Specialist Dots 接入 Agent 365(微软用来管理企业智能体的工具),企业可以用已经在用的微软工具来管理它们。
5. 新模型:更便宜的 GPT-6.1 Sol,更快的 UltraFast
Astra 发布这几周,用户的要求集中在两点:更便宜,更快。GPT-6.1 Sol(转录稿误作 Soul)的能力接近 Astra,价格是它的五分之一。缓存输入(重复发送、已被缓存的上下文)比标准输入便宜 95%。智能体需要反复读同一批上下文、长时间迭代,这对它们尤其省钱。Sam 说 Sol 在某些方面比 Astra 还聪明,定位是开发者的日常主力模型。
UltraFast 是新的速度档,API、ChatGPT 和 Codex 里都能用。原有的 Fast 档是两倍速度、两倍价格;UltraFast 是八倍速度、六倍价格,每秒 300 个 Token。它现在可以配合 Astra 用,之后也会支持 Sol。现场让两个模型用同一个提示词,做一个 DevDay 配色的火箭。UltraFast 的火箭已经升空时,标准速度的还没做完。
订阅也跟着调整。新推出的 500 美元档 Pro 订阅叫 Pro 500,额度最高,是 Plus 的 25 倍。它可以在 ChatGPT 和 Codex 里用 UltraFast,还能通过“用 ChatGPT 登录”在合作方的应用里使用。Pro 200 重新开放,继续提供所有前沿模型。
另外预览了 Decisions API。它给 Luna 模型一组预先定义好的选项,让模型从中选一个,比如给请求分流、给图片分类、决定智能体下一步做什么。任务收窄成选择题之后,响应时间可以压到一秒以内,同时保留图像理解、多语言和安全防护。Romain 后来补充说,做机器人的朋友看中的是它能处理视觉输入:机器人可以根据看到的东西,近乎实时地快速行动。
6. 模型开始帮 OpenAI 做研究
Sam 提到,去年这个时候,他和 Jakob 在一次直播里预测,一年内会出现第一个“AI 研究实习生”,当时几乎没人相信。几周前 OpenAI 宣布达成了这个目标:有了一个能接手定义清晰的研究任务的系统,这类任务原本要熟练的研究员花大量时间和精力。
Tejal 的方向是电脑操作(computer use,让模型像人一样操作桌面和浏览器)。她举了两个例子。
第一个是让模型优化电脑操作的运行框架(harness,包在模型外面、负责调用工具和管理步骤的代码)。模型在循环里持续寻找能同时降低延迟、提升效果的改动,团队把找到的改进合进生产环境的框架,并用于后训练。结果是延迟改善了两倍以上,已经上线。
第二个是模型帮忙改进了监控和拒绝训练,让 Astra 在不安全的场景里更会拒绝。Astra 在电脑操作压力测试上因此达到业内领先,操作时出错更少,也更贴合用户的本意。
她给出了几项内部数据。今年夏天之后,研究工作消耗的 Token 量急剧上升。1 月时,模型能做好 15 分钟以内的短任务,需要一天以上的任务大多会失败;到 7 月,超过三分之一的一天量级研究任务,模型能在无人干预下完成。她还提到,Astra 这类模型已经帮忙解决了 100 多个悬而未决几十年的数学问题,也在参与针对耐药感染的新抗生素、古代语言研究、可再生能源和工业机器人等方向的工作。
7. 给开发者的底层工具
Sam 说,OpenAI 想让开发者用上自己内部用的东西。
第一件是 Codex 的运行框架。它同时支撑着 Codex、ChatGPT Work 和 Dots,目标是用最少的 Token、最快拿到准确结果,现在已经开源。第二件是 Codex 完全上云:在手机上开始的任务,可以在浏览器或桌面端接着做,合上笔记本任务也不会中断。
云端能力带来了 Codex Security Cloud。它在��端环境里持续寻找漏洞,并准备好验证过的修复方案供人审核,这次新增了自动去重、定时扫描和新界面。Sam 说这是为了给防守方更好的工具,因为“我们看得到接下来会发生什么”。
新的 Agents API 进入公开测试。它包含运行框架、托管、记忆、多智能体控制等功能,是 Codex 和 Dots 用的同一套技术,也加入了电脑操作能力。现场的例子是一个网站测试智能体,会自己打开浏览器、点击页面、测试流程。基础设施方面,OpenAI 和 AWS 合作推出由 OpenAI 驱动的 Bedrock(AWS 的托管 AI 服务)托管智能体,AWS 客户可以直接使用 OpenAI 的前沿模型、Codex 和 ChatGPT Work。
隐私方面预览了 OpenAI Private Intelligence。其中的零数据留存(ZDR)配合私有安全处理,可以在不把用户内容存到 OpenAI 服务器的情况下做安全检测;私有推理则把隐私保护延伸到推理阶段。Sam 说这套方案是和最大的一批客户一起设计的,目的是让他们能把模型用在最敏感的工作上。
性能方面,Responses API 一年里增长了 100 倍,可靠性保持在 99% 以上。首个 Token 的等待时间缩短了 45%,工具调用和工作流提速 30% 以上。
8. Romain 的 Codex 演示
演示从手机上的 Codex 开始。Romain 人还在会场外,让 Codex 替他跟观众打招呼、讲一个会场的冷知识。接着他用几张会场照片生成的 3D 场景演示 UltraFast,一边说一边改:把小人放到座位上,把直播画面投到场景里的大屏幕上。现场语音没连上,他改成了打字。
Codex 命令行工具(CLI)这次全面翻新。他让 UltraFast 写一个应用,从观众里随机抽三个人送明年的门票,几秒就写完;改成抽六个人,也几乎是瞬间完成。命令行现在支持由 GPT Live 驱动的双向实时语音,不只是语音转文字,但现场没能演示出来。
后面几段演示了多模态和电脑操作。游戏 Astra Adventures 从一张纸上的草图开始,几轮之后画面还很粗糙,借助图像模型,才变成有质感、能用在正式游戏里的美术。然后他让 Astra 通过浏览器自己学着玩这个游戏,屏幕左边显示模型的决策,右边显示它按下的按键。
他又用“应用快照”(app shot)把自己记录飞行课程的应用作为上下文交给 Codex,让它在各种屏幕尺寸下审查这个应用并截图。Codex 自己在模拟器里点开了各项功能。云端 Codex 现在和本地版用同样的工具,包括插件和电脑操作。他顺手把一个“用 Rust 重写整个后端”的任务丢到云端,打算稍后在手机上查看。
最后一个演示用的是 Hugging Face 借来的可编程小机器人 Micro Duck,它名叫 Lavender。Romain 前一晚让 Codex 把它接好:视觉用 Astra,图像生成用 GPT Image 2.5,语音交互用 GPT Live 1。机器人现场看着观众画了一幅画。他说,OpenAI 做 Dots 和 Codex 用的,就是 API 里开放给开发者的同一批工具。
9. 分发和变现:让开发者在 ChatGPT 上做生意
ChatGPT 每周大约有 12 亿人使用。Sam 承认,此前类似的尝试效果参差不齐。他说这次有信心,是因为开发者拿到的是 OpenAI 自己做 ChatGPT 用的工具。
第一项是“用 ChatGPT 登录”(Sign in with ChatGPT)。用户登录第三方应用时,可以直接用自己 ChatGPT 套餐里包含的 Token,开发者不必替新用户垫付模型费用。首批有 16 家合作方。
第二项是插件扩展(plugin extensions)。开发者可以把编辑器、仪表盘乃至整个工作区,做成原生嵌在 ChatGPT 和 Codex 里的应用。现场展示了三个例子。一个是会议应用:在 ChatGPT 里看日历上的会议,点“记笔记”后,页面变成团队和 Dots 一起跟进待办的 Space。一个是 Figma:打开设计稿、看团队评论、让 ChatGPT 改稿。还有一个是 Adobe:在 ChatGPT 里使用 Photoshop 的功能。ChatGPT sites(在 ChatGPT 里生成的网站,几个月里已有数百万个)现在也能接入插件和数据。访客用自己的账号登录、带上自己的智能体,看到的内容因人而异。
用户发现插件的渠道也扩大了。除了在插件库里搜索,ChatGPT 还会在对话中识别出能帮上忙的插件,用户当场就能连接。插件审核流程也简化了:开发者可以跟踪审核进度,看到需要修改的地方,申请人工复审,更新工具时也不用从���提交。
第三项是 OpenAI Marketplace,首批有 30 多家合作方,包括 CodeRabbit、Notion、Vercel。企业客户可以用已经和 OpenAI 签下的采购承诺额度来买这些产品,有承诺额度的开发者也能在这里花。通过和模型推理托管公司 Baseten(转录稿写作 Base10)合作,市场里还能用到开源模型。
10. 收尾:一次额度重置,和“文艺复兴”的说法
当天的后续安排里,Peter 会讲 OpenAI 对开源社区的投入,包括新的 OpenClaw Enterprise Harness(OpenClaw 是一个开源 AI 智能体项目)。还有一个 Codex 游戏工作室环节,观众可以用 Codex 做复古游戏,每人能领一台 DevDay 限定的 chromatic computer,用来玩自己做的游戏。最后是 Sam、Tibo (Thibault) 和 Tejal 的现场问答。
Sam 和 Tibo 还在台上按下按钮,给全世界的用户重置了一次用量额度。Sam 说 OpenAI 已经做过太多次重置,Tibo 一直想把公司改名叫“重置公司”。
最后 Sam 说,他不喜欢把 AI 比作新一轮工业革命,那意味着人变成巨大机器里的齿轮,转得越来越快;生活里有些部分不能也不该被自动化。他希望,如果做对了,AI 带来的会更像一场新的文艺复兴:让人对自己的生活有更多掌控,有更多工具去创造、学习和探索。 OpenAI 发布全天候个人Agent: Dots:
由 GPT-6 Astra 驱动
- Dots 会主动自主推进事情,遇到关键节点才找你批准
- 它可以同时管理你的工作和家庭事物
- 它不只汇报进度,出了问题会主动想办法补救
同一个 Agent 既改董事会稿、跑代码上线,也订蛋糕、报课后班、协调女儿演出的时间冲突。
它是你的"私人管家",而不是"效率工具"... 太有节目效果了!
OpenAI 开发者大会现场直播
@thsottiaux 又送了一波重置 https://t.co/3N1ZZI3Rfq OpenAI 今天发布新 Agent:Dots。
然后网友发现一个很离谱的细节:
输入 https://t.co/rEDNE6lfRq,现在会直接跳到 Grok Bot。😂
但先别急着说“马斯克抢注了域名”。
我查了下,https://t.co/rEDNE6lfRq 早在 1994 年就注册了,现在 WHOIS 也是隐私保护,公开信息根本无法确认背后持有人是谁。
所以目前唯一能确认的是:
OpenAI 发布 Dots 的当天,https://t.co/rEDNE6lfRq 的流量入口却指向了竞争对手。
是提前布局、临时改跳转,还是单纯巧合,现在还不知道。
但作为一个产品发布乌龙,节目效果确实拉满了。
不信你点进去看看👀 就 meta 今天的股价表现,市场已经给出答案了,openai 的 dot 完全无法跟 muse 抗衡。目前来看能打败 muse 的只能是谷歌了。
我给谷歌的建议:
1.做美国的 deepseek,仗着家大业大卷死他们。
2.尽快推出基于安卓生态的个人智能体,要快!立刻马上!
3.必须推出 Gemini 的专属硬件产品,眼镜也好,音箱也罢,摄像头也行,哪怕一个灯泡都可以,但必须要有硬件!
4.去舔苹果,和苹果绑死…
5.模型基础能力追上第一梯队就行,别垫底了。
6. Antigravity 改个名字吧…
Buy the dip,长期持有,Discord在个人资料。 基于 GPT-6 Astra 模型驱动,每个 dot 都有独立的云端电脑,能够 24/7 不间断地在后台处理任务、自我学习并改进。可惜目前只有 Pro 账号才能使用。。。
https://t.co/7DO0HgWit7 https://t.co/YCE4VD6Be2

现场重置了额度(送了一张重置卡)
另外 Tibo 真的有一个重置按钮😄 https://t.co/xPmgZalsAz Dot Coming
I’m sleeping
😴 虽然今天 OpenAI 整的都是蹭热度的活,但是全都打包在 pro 会员里面了,近期确实不用退订了,产品力这一块还是拉满的,
特别是 dot 和 space 还有 agent cloud 联动,痛击对手缺胳膊少腿,生态化反了属于是。 OpenAI 发布 GPT-6.1 Sol:能力接近自家旗舰 Astra,价格只要五分之一
OpenAI 推出了中端模型 GPT-6.1 Sol,官方说法是“接近 Astra 的智能,五分之一的价格”。GPT-6 Astra 是 OpenAI 目前最强的模型,Sol 则是它下面一档、主打性价比的系列。
先看价格。API 上,GPT-6.1 Sol 每百万 token 输入 2 美元、输出 10 美元,Astra 是 10 美元和 50 美元,正好差五倍。重复使用的内容(比如每次都要带上的系统提示词、长文档)走缓存,每百万 token 只要 0.1 美元,比 GPT-6 Sol 的缓存价又便宜了一半。
对开发者来说,这意味着以前只敢在关键环节调用 Astra 的应用,现在可以把更多请求交给 Sol,账单能明显降下来。
能力上,这次升级主要在三块:写代码、操作电脑、处理复杂的专业工作。按官方数据,在软件工程测试 DeepSWE 上它追平了 Astra;在衡量“让 AI 自己操作电脑完成任务”的 OSWorld 2.0 上,比上一代 Sol 提高约 7 个百分点,离 Astra 只差约 2 个百分点。回答事实类问题时的出错率也从上一代的 11.4% 降到了 7.7%。
OpenAI 还特别提到,新模型更愿意坦白自己做不到什么,也更守规矩,不容易偏离用户意图或越过安全限制,这方面向 Astra 看齐。
现在就能用:ChatGPT 的 Plus、Pro、Business、Enterprise 和 Edu 用户可以在 ChatGPT Work 和 Codex 里直接选用,开发者在 API 里调用 gpt-6.1-sol。官方还预告了一个生成速度最高快 8 倍的极速版,稍后上线。 哇这套 3D 形象有点东西啊!OpenAI 的 Bot 正式发布! 马斯克和川普是不是故意整奥特曼,全网都在刷屏讨论 https://t.co/u4sZb5sdoV,风头完全盖过了 dot,太惨了🤦🤦,Meta 股票不跌反升,完全不受影响,我只能说,个人 agent 最后拼的不是能力,而是入口,得入口者得天下。(斜眼看下谷歌)🙄🙄
Buy the dip,长期持有,Discord在个人资料。 为什么不敢和Opus5.5比啊🤣 @OpenAI https://t.co/O2PpbFNy0D
GPT-6.1 Sol xhigh 的鹈鹕骑自行车测试结果出来了
感觉对比 6 Sol 没有多大变化和提升,动画的背景不会往前动… 但整体看着还行,至少没有错误。跟 GPT Astra 比感觉也还可以,区别不大,一个模子里刻出来的
在 Variora 看对比
https://t.co/SJBjBhd22y https://t.co/LMoNmcSQi4


OpenAI 给 Pro 会员送了个 24 小时干活的 AI 员工😳
它叫 dots,Codex 负责人 Tibo 刚发的,就是一个一直在线、替你干活的 agent
它有自己的电脑和浏览器,能连 4000 多个应用
你给它反馈它会学,它干活的时候你也能随时叫它
最关键的是它不扣额度,而且跑的是他们最强的模型 Astra,包含在 Pro 里,不占你的用量
昨天他刚说新的 200 刀 Pro 按 API 价算只值老版一半,也说过今天会加不占额度的东西,看起来就是这个
今天先给每人一个主 dot,之后能组一整队
评论区有人在问 Plus 怎么没有,原推只提了 Pro
Pro 按 API 价缩水一半,换来一个 24 小时干活的 AI 员工,这笔账你觉得划算吗? GPT-6 Sol 上周才发,今天 OpenAI 就把它升级成了 GPT-6.1 Sol。价格一分没涨,还是每百万 token 输入 2 美元、输出 10 美元,复杂编程却已经追平 Astra 了。
官方数据显示,在 DeepSWE v1.1(真实代码库里的复杂软件工程任务)上,6.1 Sol 和 GPT-6 Astra 打平,成本只有大约五分之一。它用更低的推理强度,就比 6 Sol 的最好成绩高出 6.4 个百分点。computer use 也明显变强,在 OSWorld 2.0 离线集上,最高推理强度下比 6 Sol 高 7 个百分点,成本还不到一半。
API 里已经可以用 gpt-6.1-sol,ChatGPT Work 和 Codex 从今天起对 Plus 及以上用户开放,普通聊天暂时还没有。
我感觉 Astra 的位置有点尴尬了。大部分写代码和跑 agent 的活,先用 6.1 Sol 就够,真卡住了再切 Astra。 GPT 6.1 Sol https://t.co/f1kxDpSPHj
合上电脑 Codex 还在云端跑,dots 24 小时在自己的电脑上干活,放在 Pro 里还不扣额度。OpenAI 今天 DevDay 发了 20 多样东西,基本都在做同一件事,让 AI 在你不在的时候接着干。代码审查会趁你不在先过一遍,插件能在看板上一出现新任务就自己读文档、起草计划。它卖的已经不是一个更聪明的聊天框了。
新模型、dots、Codex 更新和 500 刀的新 Pro,下面一条条说。 卧槽!Open AI Dots 不耗积分额度,
有独立环境,有浏览器!
好吧,我滑跪了!感谢义夫! @thsottiaux https://t.co/8fktAPaQKw
OpenAI 刚在 DevDay 发了 Dots,我第一反应是这不就是 OpenAI 版的 Grok bot。
以前用 ChatGPT 得先打开 App 再跟它聊,Dots 更像通讯录里多了一个联系人。你可以给它发短信、打电话、在 Slack 里找它、给它发邮件,它就在你本来就在用的地方回你。每个 Dot 跑在自己的一台电脑上,一直在线,要花钱买东西会先等你批准,还能给它捏一个 3D 形象。
Dots 直接住进你所有的沟通渠道。 personal agent最后很大概率又成了剃头挑子一头热。
因为绝大多数消费用户都用过了chatgpt、豆包、claude,能做的工作基本已经覆盖了,何况chatgpt和claude内部500年前就给你提供了一个受限container用了,
绝大多数用户如果有额外专业需求,早就想办法用claude code或者chatgpt(codex)来工作了。
personal agent最终还是浪费非常多的token,来满足消费用户的一些非常浅薄无知的小白功能,比如问个药,问个路,推荐个菜馆,最终发现给你一个类似manus的环境和一堆丰富的container,你还是拿他来当大豆包来用。
openclaw已经帮所有人试错过一次了,绝大多数所谓的非CS民办三本文科傻逼们安装完了以后,能想到的最大的用途,就是到处抄文章、搜热点、洗稿、发布洗稿文章。
AI利好全部数据
OpenAI DevDay发布Dots与GPT-6.1 Sol:现场重置额度与域名乌龙热议
OpenAI在旧金山举办DevDay开发者大会,CEO萨姆·奥特曼携团队正式展示个人Agent产品Dots以及性价比中端模型GPT-6.1 Sol。官方介绍GPT-6.1 Sol具备接近旗舰Astra的智能水平,但调用价格降至五分之一。大会现场官方重置了额度福利,引发开发者互动。与此同时,网友发现Dots相关域名跳转至马斯克旗下的Grok Bot,引发对域名抢注与巨头博弈的戏剧性讨论;部分美股观察者指出Meta股价并未受Dots发布冲击,认为个人Agent竞争最终比拼的是底层生态与硬件入口。
#OpenAI DevDay#Dots#GPT-6.1 Sol#Astra#Sam Altman
话题热度
329
帖子数
35
曝光
26.1万
参与创作者
21
话题热度趋势
从首次出现到最后更新;不足 7 天时补足 7 天观察窗。
全部关联帖子
共 35 条




































