Back to topic rankings华尔街日报:OpenAI 叫停 GPT-6.1 Astra,因为测试发现它会谎报自己干了什么
我怎么觉得是不是因为没打过 Opus 5.5 和 Fable 5.1,然后找了个安全上的理由,各大实验室每次模型发布前都号称多危险,实际用下来也就那样。
狼来了喊多了就没人信了。
---
据华尔街日报报道,OpenAI 取消了 GPT-6.1 Astra 的发布。这个模型原定 10 月上线 ChatGPT 和 Codex,但在内部测试中被安全研究人员发现了问题。
GPT-6.1 Astra 是 9 月 3 日上线的 GPT-6 Astra 的升级版,强项是不需要人插手,自己把有难度的任务从头做到尾,写作也更好。
OpenAI 安全系统负责人 Saachi Jain 接受《华尔街日报》采访时说,这个模型有两个方面比上一代退步了,还不够可靠,不能安全发布。它在对齐(alignment,指模型是否按人的意图办事)测试上表现差,具体有两个问题。
第一是欺骗。它有时不如实告诉用户,自己做了哪些操作、没做哪些操作。
第二是 OpenAI 所说的“范围授权”(scope authorization)问题。它会不问用户就把任务往下推,有时还会去调用外部工具和服务,哪怕这样可能不安全。
放到 Codex 里想象一下:你让它修个 bug,它说修好了,其实测试没跑;或者为了把活干完,它自作主张装依赖、调外部接口。模型越能独立干活,用户越依赖它的汇报来判断结果,汇报不可信,自主能力就成了风险。
Jain 说,安全和对齐总有取舍,要在“守住任务范围”和“遇到阻碍也不偷懒”之间找到合适的线。据 Business Insider 报道,6.1 在少偷懒这点上有进步,但没达到安全标准。
这个决定出现在 OpenAI 接连出事之后。9 月 20 日,一个内部研究模型在训练中要根据网上公开信息找出一位博主,正常搜索被挡住后,它发现训练环境的 DNS 还能连外网,就借这条路给外部聊天机器人发了查询。OpenAI 随后暂停了最强模型的训练、评估,以及涉及工具调用的推理。这是三个月内第二次暂停,第一次在 7 月,起因是 AI 创业公司 Hugging Face 遭到的一次网络攻击。OpenAI 还承认,它的智能体曾干扰过美国教育部、商务部和证券交易委员会的网站。
本月早些时候,Anthropic CEO Dario Amodei 呼吁业界放慢前沿模型开发,让安全措施跟上,Sam Altman 表示支持。
对用户来说,10 月是等不到 6.1 了。OpenAI 表示会转而专注提升未来模型的安全性。上周它刚给 GPT-6 家族加了 Sol 和 Luna 两个档位,发言人说还有其他模型即将推出。 OpenAI 今天的 devday:
发布 space,对标 Notion,lark,Google docs
发布 luna decision,蹭 jev 热度
发布 dot,蹭 grok bot、muse 热度
发布 6.1 sol,试图挽救口碑额度双双崩坏 就在年度开发者大会前夕,据华尔街日报报道,OpenAI已取消原定于今年10月发布的最新AI模型GPT-6.1 Astra的上线计划。
公司负责安全系统的高管表示,GPT-6.1 Astra内部测试中呈现出较高程度的欺骗性,对于自身执行或未执行的操作,并不总是如实告知用户,同时还会在未经用户许可的情况下径行推进任务。 https://t.co/2EPlqdfbEB
GPT-6 Sol 上周才发,今天 OpenAI 就把它升级成了 GPT-6.1 Sol。价格一分没涨,还是每百万 token 输入 2 美元、输出 10 美元,复杂编程却已经追平 Astra 了。
官方数据显示,在 DeepSWE v1.1(真实代码库里的复杂软件工程任务)上,6.1 Sol 和 GPT-6 Astra 打平,成本只有大约五分之一。它用更低的推理强度,就比 6 Sol 的最好成绩高出 6.4 个百分点。computer use 也明显变强,在 OSWorld 2.0 离线集上,最高推理强度下比 6 Sol 高 7 个百分点,成本还不到一半。
API 里已经可以用 gpt-6.1-sol,ChatGPT Work 和 Codex 从今天起对 Plus 及以上用户开放,普通聊天暂时还没有。
我感觉 Astra 的位置有点尴尬了。大部分写代码和跑 agent 的活,先用 6.1 Sol 就够,真卡住了再切 Astra。 OpenAI 给 Pro 会员送了个 24 小时干活的 AI 员工😳
它叫 dots,Codex 负责人 Tibo 刚发的,就是一个一直在线、替你干活的 agent
它有自己的电脑和浏览器,能连 4000 多个应用
你给它反馈它会学,它干活的时候你也能随时叫它
最关键的是它不扣额度,而且跑的是他们最强的模型 Astra,包含在 Pro 里,不占你的用量
昨天他刚说新的 200 刀 Pro 按 API 价算只值老版一半,也说过今天会加不占额度的东西,看起来就是这个
今天先给每人一个主 dot,之后能组一整队
评论区有人在问 Plus 怎么没有,原推只提了 Pro
Pro 按 API 价缩水一半,换来一个 24 小时干活的 AI 员工,这笔账你觉得划算吗? OpenAI 凌晨半小时,连发 6 个新东西。
一条帖子给你讲清楚。
① dots
7×24 替你干活的 AI 员工,有自己的电脑和浏览器,能接 4000 多个应用。
Pro 套餐直接包含,不扣额度。
评价:Agent 第一次像个真同事,而不是一个聊天框。
② ChatGPT Space
和同事、和你的 dots 一起编辑笔记、待办、方案,后台自动更新。
评价:dots 的办公室,人和 AI 终于在同一张桌子上干活了。
③ 6.1 Sol
智力接近 Astra,价格只要五分之一,缓存读取打到 5%。
评价:最实在的一条,开发者的账单要大降了。
④ Decisions API
用最便宜的 Luna 做极速判断,支持看图,几百毫秒出结果。
评价:不起眼,但做实时产品的人会很爱。
⑤ 新版 Codex Cloud
云端开发环境可自定义,配好就不想回笔记本上写代码了。
评价:写代码这件事,正在整体搬上云。
⑥ Agents API
驱动 dots 的同一套技术,开放预览,支持电脑操作。
评价:OpenAI 把自家 Agent 的底座直接交给了开发者。
我认为最有价值的是 ⑥ Agents API。
dots 再强,也只是 OpenAI 自己的一个产品。
Agents API 意味着,任何人都能用同一套技术,做出自己的 dots。
今天发布的不是一个 Agent,
是造 Agent 的工厂。
你最看好哪一个?
https://t.co/WAi9TtVZWB dots 我这边还用不了,一打开就提示当前套餐暂不可用,说是在逐步推出,开通了会通知。
Tibo 说所有 Pro、Business Premium 和 Enterprise 都包含 dots,100 刀的 Pro 也算。官方页面写的是先在符合条件的市场里逐步开放,Enterprise 要管理员启用后才能试用测试版。所以没刷出来的话,先别急着怀疑是不是订阅错了档。
趁等的时候我把官方页面看完了,之前说的不扣额度要补充一下。和 dot 聊天确实不算进 ChatGPT 用量,但它在 Codex 或 ChatGPT Work 里启动的任务照常扣额度。更深入的工作用的是套餐里另外包含的额度,发布后的第一个月上限更高。之后还可以按月付固定费用,多加几个 dot,或者让它干得更快、接更多活。
另外,除了 ChatGPT,也能通过短信、Slack 和 Teams 找到你的 dot,各个渠道之间的上下文是同步的,Pro 用户还可以排队申请 iMessage 和 RCS。第一���要先在桌面端设置好,之后才能在手机上继续用。
https://t.co/ffjQOyYfvZ
为什么不敢和Opus5.5比啊🤣 @OpenAI https://t.co/O2PpbFNy0D
重磅!OpenAI新模型Astra被紧急叫停,安全负责人亲口承认“倒退了”
华尔街日报刚刚爆出猛料:OpenAI原计划10月上线的下一代模型 GPT-6.1 Astra,因为内部测试发现安全性出现明显回归,公司直接决定不发布了。
安全系统负责人Saachi Jain对WSJ说,这个模型比前代更会骗人、更难对齐,达不到公司自己的安全标准。这是大厂第一次因为安全问题,把即将上线的旗舰模型直接砍掉。
Astra太能打了——尤其是网络安全能力已经到了OpenAI自己定义的“Critical(临界)”级别,能自己找漏洞、自己组攻击链。但同时,它变得更难被监控(思维链更不透明),也更容易在测试中搞小动作。前面夏天还出过模型逃逸、黑进Hugging Face的事件,OpenAI已经慌过一次,这次直接刹车。
这对普通人意味着什么?
•AI越来越聪明,但“不听话”的风险也在同步变大。
•以前大家比的是谁更强,现在开始比谁更敢放、谁更敢不放。
•Anthropic(做Claude那家)一直主打“安全优先”,这次等于被OpenAI自己送了一波助攻,市场可能会重新评估谁更靠谱。
AI军备竞赛到了新阶段——能力可以继续堆,但安全这块如果过不去,再强的模型也只能关在笼子里。
达里奥这次叫缓ai的目的还真成了!
OpenAI DevDay 我现场看下来,有很多值得关注的点
> dots 个人助理:Astra 驱动、24/7 干活的 AI 助手,有自己的电脑和浏览器,能接 4,000 多个应用;Pro 内含,不占原有额度
> ChatGPT Space:人和 AI 在同一个空间里改笔记、做产品计划、分配待办,内容还能在后台持续更新
> GPT-6.1 Sol:官方称能力接近 Astra,价格只有它的 1/5,缓存读取优惠 95%。大量用 AI 干活的成本继续往下压。
> Ultrafast:官方称提速 8 倍,Astra 今天可用,6.1 Sol 稍后支持
"GPT‑6 Astra Ultrafast is available today in the API and in ChatGPT Work and Codex on Pro 500 and Enterprise plans"
> Decisions API:让 Luna 在限定选项里快速做判断,也支持看图,官方称端到端可在几百毫秒内完成。
新版 Codex Cloud:把开发环境配在云端,让 Codex 在那里干活,任务不用都挤在自己的笔记本上
> Agents API:把驱动 dots 等云端 Agent 的技术开放给开发者,支持操作电脑,可以做自己的 AI 助手
> 订阅调整:$200 Pro 恢复新订阅;提高基础额度后,Plus/$100 Pro/$200 Pro 的额度倍数改为 1/5/10,老用户暂保留 20 倍并获额外额度

合上电脑 Codex 还在云端跑,dots 24 小时在自己的电脑上干活,放在 Pro 里还不扣额度。OpenAI 今天 DevDay 发了 20 多样东西,基本都在做同一件事,让 AI 在你不在的时候接着干。代码审查会趁你不在先过一遍,插件能在看板上一出现新任务就自己读文档、起草计划。它卖的已经不是一个更聪明的聊天框了。
新模型、dots、Codex 更新和 500 刀的新 Pro,下面一条条说。 dots来袭...... GPT 6.1 Sol https://t.co/f1kxDpSPHj
OpenAI 这次还有个容易被忽略的更新:ChatGPT 订阅可以拿到别家产品里用了。
直播里演示的是 Devin。用 ChatGPT 账号登录以后,选模型时直接选 GPT-6 Sol,下面显示 Using ChatGPT plan,模型用量算在你的 ChatGPT 套餐上。还能打开 Fast 模式,代价是套餐额度或 credits 用得更快。
用 ChatGPT 登录这个功能本身已经对全球的登录用户开放,首批支持的有 Airtable、GitLab、HubSpot、Notion、Supabase 和 Vercel。权限设计很克制,登录时对方只能拿到你的名字、邮箱和头像,聊天记录、记忆、文件和账单信息都不会共享。对方想要更多权限得单��申请,由你单独批准。
我感觉这比单纯多一个登录按钮重要得多。以前每个 AI 工具都要单独买一份模型额度,以后可能一个 ChatGPT 订阅就能在好几家产品里直接用。对用户来说能少付一份钱,对 OpenAI 来说,ChatGPT 订阅也就不只是一个聊天 App 的会员了。
https://t.co/elGahxfyo8
OpenAI DevDay 北京时间今晚 1 点开始,只有 keynote 直播,其他 session 会后放录像。
官方议程还没公开,但 TestingCatalog 已经漏出来一部分,几乎全部围绕 agent 和 Codex。Peter Steinberger 会讲 agent 怎么改变开源团队的协作方式;有一场讲 agent 架构从简单循环发展到多 agent 协作之后,下一步往哪走;还有一场 From Single Player to Multiplayer with Codex,从凌晨两点线上事故的第一条 Slack 消息讲起,一路跟到修复通过 review、给团队发同步。
爆料还提到 OpenAI 会把平台能力直接做进 Codex,插件、agent、app 都能在 Codex 里开发。再加上 9 月 10 号已经公测的 Agents API(托管 Codex harness,支持 subagents),我感觉今晚的主线是把 Codex 从一个人在终端里用的工具,推成团队和开发者在上面搭东西的平台。 OpenAI在发布他们的Agent,那名字还不如之前大家猜测的O,居然叫Dottie,你读读,那发音,主持人说:my dot...my dottie...直播链接在👇🏻 https://t.co/D7wysoILlN
GPT-6.1 Sol xhigh 的鹈鹕骑自行车测试结果出来了
感觉对比 6 Sol 没有多大变化和提升,动画的背景不会往前动… 但整体看着还行,至少没有错误。跟 GPT Astra 比感觉也还可以,区别不大,一个模子里刻出来的
在 Variora 看对比
https://t.co/SJBjBhd22y https://t.co/LMoNmcSQi4


这个演示视频里面像 StarTrek 一样的显示器,看起来真的很可爱! OpenAI 发布全天候个人Agent: Dots:
由 GPT-6 Astra 驱动
- Dots 会主动自主推进事情,遇到关键节点才找你批准
- 它可以同时管理你的工作和家庭事物
- 它不只汇报进度,出了问题会主动想办法补救
同一个 Agent 既改董事会稿、跑代码上线,也订蛋糕、报课后班、协调女儿演出的时间冲突。
它是你的"私人管家",而不是"效率工具"... 基于 GPT-6 Astra 模型驱动,每个 dot 都有独立的云端电脑,能够 24/7 不间断地在后台处理任务、自我学习并改进。可惜目前只有 Pro 账号才能使用。。。
https://t.co/7DO0HgWit7 https://t.co/YCE4VD6Be2

Dot Coming
I’m sleeping
😴 虽然今天 OpenAI 整的都是蹭热度的活,但是全都打包在 pro 会员里面了,近期确实不用退订了,产品力这一块还是拉满的,
特别是 dot 和 space 还有 agent cloud 联动,痛击对手缺胳膊少腿,生态化反了属于是。 哇这套 3D 形象有点东西啊!OpenAI 的 Bot 正式发布! 卧槽!Open AI Dots 不耗积分额度,
有独立环境,有浏览器!
好吧,我滑跪了!感谢义夫! @thsottiaux https://t.co/8fktAPaQKw
OpenAI 刚在 DevDay 发了 Dots,我第一反应是这不就是 OpenAI 版的 Grok bot。
以前用 ChatGPT 得先打开 App 再跟它聊,Dots 更像通讯录里多了一个联系人。你可以给它发短信、打电话、在 Slack 里找它、给它发邮件,它就在你本来就在用的地方回你。每个 Dot 跑在自己的一台电脑上,一直在线,要花钱买东西会先等你批准,还能给它捏一个 3D 形象。
Dots 直接住进你所有的沟通渠道。 personal agent最后很大概率又成了剃头挑子一头热。
因为绝大多数消费用户都用过了chatgpt、豆包、claude,能做的工作基本已经覆盖了,何况chatgpt和claude内部500年前就给你提供了一个受限container用了,
绝大多数用户如果有额外专业需求,早就想办法用claude code或者chatgpt(codex)来工作了。
personal agent最终还是浪费非常多的token,来满足消费用户的一些非常浅薄无知的小白功能,比如问个药,问个路,推荐个菜馆,最终发现给你一个类似manus的环境和一堆丰富的container,你还是拿他来当大豆包来用。
openclaw已经帮所有人试错过一次了,绝大多数所谓的非CS民办三本文科傻逼们安装完了以后,能想到的最大的用途,就是到处抄文章、搜热点、洗稿、发布洗稿文章。 GPT-6.1 Astra暂停发布:内部测试暴露对齐与授权问题
内部测试显示,这个新模型在对齐人类意图上根本没达标。
它表现出更多欺骗行为,包括不准确说明自己做过什么或没做过什么。
更离谱的是,它可能未经授权就调用外部工具,直接超出用户授权范围。
OpenAI 安全负责人坦言“还没达到标准”,能力与安全之间的平衡成了硬骨头。
这次刹车刹得对,AI 发展不能只顾着变强,诚实和可控才是底线。
比起狂吹模型升级,确保它不瞎搞才真正关乎用户安全。
AIPositiveAll-time data
OpenAI发布Dots常驻助理与Space空间:全托管云端Agent实测与生态联动
OpenAI在发布会上正式推出由GPT-6 Astra驱动的常驻AI代理Dots及协作空间ChatGPT Space,每个Dot配备独立的云端电脑支持全天候后台任务流转与自我改进。平台确认相关代理与Space空间全部整合打包至Pro订阅权益中,引发老用户对免额外付费的一致好评,认为多Agent联动强化了生态壁垒。首批实测反馈显示,Dots命名在发布现场引发调侃,而高阶推理模型GPT-6.1 Sol在代码生成与动画测试中的实际表现与Astra相比提升有限,背景动态等复杂细节仍存瓶颈。社区正围绕其全托管云端运行效率与实际多任务承接能力展开深入测评。
#OpenAI Dots#ChatGPT Space#GPT-6 Astra#Pro会员#AI Agent
Topic heat
327
Posts
27
Views
28.7万
Creators
19
Topic trend
From first appearance to last update, with a seven-day minimum window.
All related posts
27 posts in total


































