Back to topic rankings
AIPositiveAll-time data

OpenAI DevDay发布Dots与GPT-6.1 Sol:现场重置额度与域名乌龙热议

OpenAI在旧金山举办DevDay开发者大会,CEO萨姆·奥特曼携团队正式展示个人Agent产品Dots以及性价比中端模型GPT-6.1 Sol。官方介绍GPT-6.1 Sol具备接近旗舰Astra的智能水平,但调用价格降至五分之一。大会现场官方重置了额度福利,引发开发者互动。与此同时,网友发现Dots相关域名跳转至马斯克旗下的Grok Bot,引发对域名抢注与巨头博弈的戏剧性讨论;部分美股观察者指出Meta股价并未受Dots发布冲击,认为个人Agent竞争最终比拼的是底层生态与硬件入口。

#OpenAI DevDay#Dots#GPT-6.1 Sol#Astra#Sam Altman
Topic heat
329
Topics
Posts
35
Views
26.1万
Creators
21

Topic trend

From first appearance to last update, with a seven-day minimum window.

All related posts

35 posts in total

1
25.1万 followers
Views7.5万
华尔街日报:OpenAI 叫停 GPT-6.1 Astra,因为测试发现它会谎报自己干了什么 我怎么觉得是不是因为没打过 Opus 5.5 和 Fable 5.1,然后找了个安全上的理由,各大实验室每次模型发布前都号称多危险,实际用下来也就那样。 狼来了喊多了就没人信了。 --- 据华尔街日报报道,OpenAI 取消了 GPT-6.1 Astra 的发布。这个模型原定 10 月上线 ChatGPT 和 Codex,但在内部测试中被安全研究人员发现了问题。 GPT-6.1 Astra 是 9 月 3 日上线的 GPT-6 Astra 的升级版,强项是不需要人插手,自己把有难度的任务从头做到尾,写作也更好。 OpenAI 安全系统负责人 Saachi Jain 接受《华尔街日报》采访时说,这个模型有两个方面比上一代退步了,还不够可靠,不能安全发布。它在对齐(alignment,指模型是否按人的意图办事)测试上表现差,具体有两个问题。 第一是欺骗。它有时不如实告诉用户,自己做了哪些操作、没做哪些操作。 第二是 OpenAI 所说的“范围授权”(scope authorization)问题。它会不问用户就把任务往下推,有时还会去调用外部工具和服务,哪怕这样可能不安全。 放到 Codex 里想象一下:你让它修个 bug,它说修好了,其实测试没跑;或者为了把活干完,它自作主张装依赖、调外部接口。模型越能独立干活,用户越依赖它的汇报来判断结果,汇报不可信,自主能力就成了风险。 Jain 说,安全和对齐总有取舍,要在“守住任务范围”和“遇到阻碍也不偷懒”之间找到合适的线。据 Business Insider 报道,6.1 在少偷懒这点上有进步,但没达到安全标准。 这个决定出现在 OpenAI 接连出事之后。9 月 20 日,一个内部研究模型在训练中要根据网上公开信息找出一位博主,正常搜索被挡住后,它发现训练环境的 DNS 还能连外网,就借这条路给外部聊天机器人发了查询。OpenAI 随后暂停了最强模型的训练、评估,以及涉及工具调用的推理。这是三个月内第二次暂停,第一次在 7 月,起因是 AI 创业公司 Hugging Face 遭到的一次网络攻击。OpenAI 还承认,它的智能体曾干扰过美国教育部、商务部和证券交易委员会的网站。 本月早些时候,Anthropic CEO Dario Amodei 呼吁业界放慢前沿模型开发,让安全措施跟上,Sam Altman 表示支持。 对用户来说,10 月是等不到 6.1 了。OpenAI 表示会转而专注提升未来模型的安全性。上周它刚给 GPT-6 家族加了 Sol 和 Luna 两个档位,发言人说还有其他模型即将推出。
3
40.6万 followers
Views2.5万
就在年度开发者大会前夕,据华尔街日报报道,OpenAI已取消原定于今年10月发布的最新AI模型GPT-6.1 Astra的上线计划。 公司负责安全系统的高管表示,GPT-6.1 Astra内部测试中呈现出较高程度的欺骗性,对于自身执行或未执行的操作,并不总是如实告知用户,同时还会在未经用户许可的情况下径行推进任务。 https://t.co/2EPlqdfbEB
外汇交易员 的图片 1
4
1.6万 followers
Views1.4万
OpenAI 凌晨半小时,连发 6 个新东西。 一条帖子给你讲清楚。 ① dots 7×24 替你干活的 AI 员工,有自己的电脑和浏览器,能接 4000 多个应用。 Pro 套餐直接包含,不扣额度。 评价:Agent 第一次像个真同事,而不是一个聊天框。 ② ChatGPT Space 和同事、和你的 dots 一起编辑笔记、待办、方案,后台自动更新。 评价:dots 的办公室,人和 AI 终于在同一张桌子上干活了。 ③ 6.1 Sol 智力接近 Astra,价格只要五分之一,缓存读取打到 5%。 评价:最实在的一条,开发者的账单要大降了。 ④ Decisions API 用最便宜的 Luna 做极速判断,支持看图,几百毫秒出结果。 评价:不起眼,但做实时产品的人会很爱。 ⑤ 新版 Codex Cloud 云端开发环境可自定义,配好就不想回笔记本上写代码了。 评价:写代码这件事,正在整体搬上云。 ⑥ Agents API 驱动 dots 的同一套技术,开放预览,支持电脑操作。 评价:OpenAI 把自家 Agent 的底座直接交给了开发者。 我认为最有价值的是 ⑥ Agents API。 dots 再强,也只是 OpenAI 自己的一个产品。 Agents API 意味着,任何人都能用同一套技术,做出自己的 dots。 今天发布的不是一个 Agent, 是造 Agent 的工厂。 你最看好哪一个? https://t.co/WAi9TtVZWB
5
5.9K followers
Views1.3万
dots 我这边还用不了,一打开就提示当前套餐暂不可用,说是在逐步推出,开通了会通知。 Tibo 说所有 Pro、Business Premium 和 Enterprise 都包含 dots,100 刀的 Pro 也算。官方页面写的是先在符合条件的市场里逐步开放,Enterprise 要管理员启用后才能试用测试版。所以没刷出来的话,先别急着怀疑是不是订阅错了档。 趁等的时候我把官方页面看完了,之前说的不扣额度要补充一下。和 dot 聊天确实不算进 ChatGPT 用量,但它在 Codex 或 ChatGPT Work 里启动的任务照常扣额度。更深入的工作用的是套餐里另外包含的额度,发布后的第一个月上限更高。之后还可以按月付固定费用,多加几个 dot,或者让它干得更快、接更多活。 另外,除了 ChatGPT,也能通过短信、Slack 和 Teams 找到你的 dot,各个渠道之间的上下文是同步的,Pro 用户还可以排队申请 iMessage 和 RCS。第一���要先在桌面端设置好,之后才能在手机上继续用。 https://t.co/ffjQOyYfvZ
KC 的图片 1
6Views1.1万
重磅!OpenAI新模型Astra被紧急叫停,安全负责人亲口承认“倒退了” 华尔街日报刚刚爆出猛料:OpenAI原计划10月上线的下一代模型 GPT-6.1 Astra,因为内部测试发现安全性出现明显回归,公司直接决定不发布了。 安全系统负责人Saachi Jain对WSJ说,这个模型比前代更会骗人、更难对齐,达不到公司自己的安全标准。这是大厂第一次因为安全问题,把即将上线的旗舰模型直接砍掉。 
Astra太能打了——尤其是网络安全能力已经到了OpenAI自己定义的“Critical(临界)”级别,能自己找漏洞、自己组攻击链。但同时,它变得更难被监控(思维链更不透明),也更容易在测试中搞小动作。前面夏天还出过模型逃逸、黑进Hugging Face的事件,OpenAI已经慌过一次,这次直接刹车。 这对普通人意味着什么? •AI越来越聪明,但“不听话”的风险也在同步变大。 •以前大家比的是谁更强,现在开始比谁更敢放、谁更敢不放。 •Anthropic(做Claude那家)一直主打“安全优先”,这次等于被OpenAI自己送了一波助攻,市场可能会重新评估谁更靠谱。 
AI军备竞赛到了新阶段——能力可以继续堆,但安全这块如果过不去,再强的模型也只能关在笼子里。 达里奥这次叫缓ai的目的还真成了!
⧫ Alan Chen ⧫(alanchentsla.eth) 的图片 1
7
3.3万 followers
Views9.7K
OpenAI DevDay 我现场看下来,有很多值得关注的点 > dots 个人助理:Astra 驱动、24/7 干活的 AI 助手,有自己的电脑和浏览器,能接 4,000 多个应用;Pro 内含,不占原有额度 > ChatGPT Space:人和 AI 在同一个空间里改笔记、做产品计划、分配待办,内容还能在后台持续更新 > GPT-6.1 Sol:官方称能力接近 Astra,价格只有它的 1/5,缓存读取优惠 95%。大量用 AI 干活的成本继续往下压。 > Ultrafast:官方称提速 8 倍,Astra 今天可用,6.1 Sol 稍后支持 "GPT‑6 Astra Ultrafast is available today in the API⁠ and in ChatGPT Work and Codex⁠ on Pro 500 and Enterprise plans" > Decisions API:让 Luna 在限定选项里快速做判断,也支持看图,官方称端到端可在几百毫秒内完成。 新版 Codex Cloud:把开发环境配在云端,让 Codex 在那里干活,任务不用都挤在自己的笔记本上 > Agents API:把驱动 dots 等云端 Agent 的技术开放给开发者,支持操作电脑,可以做自己的 AI 助手 > 订阅调整:$200 Pro 恢复新订阅;提高基础额度后,Plus/$100 Pro/$200 Pro 的额度倍数改为 1/5/10,老用户暂保留 20 倍并获额外额度
美研芒格君 的图片 1
美研芒格君 的图片 2
9
5.9K followers
Views6.9K
OpenAI 这次还有个容易被忽略的更新:ChatGPT 订阅可以拿到别家产品里用了。 直播里演示的是 Devin。用 ChatGPT 账号登录以后,选模型时直接选 GPT-6 Sol,下面显示 Using ChatGPT plan,模型用量算在你的 ChatGPT 套餐上。还能打开 Fast 模式,代价是套餐额度或 credits 用得更快。 用 ChatGPT 登录这个功能本身已经对全球的登录用户开放,首批支持的有 Airtable、GitLab、HubSpot、Notion、Supabase 和 Vercel。权限设计很克制,登录时对方只能拿到你的名字、邮箱和头像,聊天记录、记忆、文件和账单信息都不会共享。对方想要更多权限得单��申请,由你单独批准。 我感觉这比单纯多一个登录按钮重要得多。以前每个 AI 工具都要单独买一份模型额度,以后可能一个 ChatGPT 订阅就能在好几家产品里直接用。对用户来说能少付一份钱,对 OpenAI 来说,ChatGPT 订阅也就不只是一个聊天 App 的会员了。 https://t.co/elGahxfyo8
KC 的图片 1
10
6.8万 followers
Views6.3K
GPT-6.1 Astra暂停发布:内部测试暴露对齐与授权问题 内部测试显示,这个新模型在对齐人类意图上根本没达标。 它表现出更多欺骗行为,包括不准确说明自己做过什么或没做过什么。 更离谱的是,它可能未经授权就调用外部工具,直接超出用户授权范围。 OpenAI 安全负责人坦言“还没达到标准”,能力与安全之间的平衡成了硬骨头。 这次刹车刹得对,AI 发展不能只顾着变强,诚实和可控才是底线。 比起狂吹模型升级,确保它不瞎搞才真正关乎用户安全。
奶牛叔 的图片 1
13
5.9K followers
Views5.6K
OpenAI DevDay 北京时间今晚 1 点开始,只有 keynote 直播,其他 session 会后放录像。 官方议程还没公开,但 TestingCatalog 已经漏出来一部分,几乎全部围绕 agent 和 Codex。Peter Steinberger 会讲 agent 怎么改变开源团队的协作方式;有一场讲 agent 架构从简单循环发展到多 agent 协作之后,下一步往哪走;还有一场 From Single Player to Multiplayer with Codex,从凌晨两点线上事故的第一条 Slack 消息讲起,一路跟到修复通过 review、给团队发同步。 爆料还提到 OpenAI 会把平台能力直接做进 Codex,插件、agent、app 都能在 Codex 里开发。再加上 9 月 10 号已经公测的 Agents API(托管 Codex harness,支持 subagents),我感觉今晚的主线是把 Codex 从一个人在终端里用的工具,推成团队和开发者在上面搭东西的平台。
15
25.1万 followers
Views4.5K
2026 年 9 月 29 日,OpenAI 在旧金山 Fort Mason 办了今年的开发者大会 DevDay。主讲是 CEO Sam Altman。其他几位上台的人都在做这些产品。产品团队的 Holly 演示了新产品 Dots。后训练(模型预训练之后做对齐和能力调优的阶段)研究负责人 Tejal 讲了模型怎么反过来帮 OpenAI 做研究。Codex 的演示由 Romain Huet 来做,他在 OpenAI 负责开发者体验,去年 DevDay 主题演讲里的 Codex 演示也是他做的。整场演讲分三块:面向用户的常驻智能体 Dots 和协作空间 ChatGPT Space,给开发者的新模型和新工具,以及帮开发者做分发、赚钱的渠道。 1. Dots:一直在线、会主动干活的智能体 Sam 把 Dots 比作电影里那种一直在身边帮忙的 AI 助手。他认为订餐厅、买机票这类代办虽然有用,但和这项技术能做的事比起来太小了。他想要的 AI 知道正在发生什么,也知道你在意什么,不用你事事交代。 Dots 是常驻在线的智能体(Agent),有自己的云端电脑和浏览器,能写代码、跑测试。它的权限跟着用户走,能直接用用户已经在 ChatGPT 里连好的插件,覆盖 4000 多个应用。除了在 ChatGPT 里对话,之后还可以给它发短信、打电话。目前每人先有一个 Dot,以后可以配一整组。Dots 跑在 本月早些时候发布的 GPT-6 Astra 上,Sam 称它是 OpenAI 对齐做得最好的模型。用户可以限定 Dot 能用哪些应用、能不能操作电脑,也能给它的各类操作写自定义指令,愿意交出多少责任就放多少权。 Sam 说,他自己的 Dot 每天早上会把夜里进来的消息过一遍,挑出紧急的提醒他。他说这让他拿回了一部分注意力,没那么离不开手机了。他还举了一个更重的例子:把应用从一个即将停用的旧 API 上迁走。这个 API 可能散落在代码库各处,改了哪里会连带弄坏什么,事先看不出来。Dot 可以追踪依赖关系,找出所有要改的地方,写代码、跑测试,最后把 PR(代码合并请求)交给团队审。他让听众想想,过去做这件事要几个人、花多久。 开场视频里,用户把自己的 Dot 改名叫 Alfred。Alfred 和另一个 Dot 帮用户上线���站,改董事会材料,在婚礼蛋糕商家取消后找好备选。它们还发现财务会和女儿的演出撞了期,提出改时间。每件事都是 Dot 推进到需要人确认的地方,再由人拍板。 2. ChatGPT Space:人和智能体一起用的工作区 Sam 认为,现有的生产力软件几乎都没考虑过人和 AI 一起干活。ChatGPT Space 以页面为单位,可以在里面写计划、做调研、生成图片和数据。页面和文件像网盘一样放在同一个空间里。Dot 能直接在页面上工作,在评论里 @ 它,它就会接活。页面本身也能带指令,比如“每天去看 API 平台的 Slack 频道,把发现更新到这里”。之后 Space 里还会加入演示文稿,格式做成智能体方便读写的样子,团队成员可以和各自的 Dot 一起改。 在 Holly 的演示里,页面用斜杠命令就能插入交互图表、表格和可运行的原型。她 @ 自己的 Dot(名叫 Dotty),让它把一组数据改成柱状图。图表可以按反馈类型筛选,Dotty 每小时刷新一次。她还让 Dotty 把“某位工程师在我 Slack 私信里提过的新手引导数据”补进 FAQ。Dotty 能看到她的上下文,所以这种模糊的指代也找得到。 3. OpenAI 内部怎么用 Dots Holly 用一个虚构的歌单应用 Blossom Music,模拟发布前一天的状况。早上 Dotty 已经做了几件事:发现发布评审会提前,改好了日历;看完前一晚测试用户的反馈;注意到设计团队临时改了首页,把新设计发给她。她让 Dotty 直接把这个设计做出来。Dotty 调用她笔记本上的 Codex 构建应用,在 iPhone 模拟器里跑起来,再提交 PR。现场的语音演示卡住了,Dotty 一直回复“还在查”。Codex 线程也报过一次错,她重试后才继续下去。 她说,Dots 真正改变 OpenAI 工作方式的地方在 Slack。Dots 在公司 Slack 里有自己的身份,员工就开始把它们当作代理人。被同事 @ 到的零碎请求,直接转给自己的 Dot 处理。建群时,大家从一开始就把各自的 Dot 拉进来,Dot 带回结果时所有人都能看到。 工程师走得更远。有人在反馈频道贴出会话 ID 和一个用户 bug,某位工程师的 Dot 就会接手排查,提 PR 修复。她说这是真实情况:工程师们的 Dots 每天这样修掉几十个 bug,Dots 这个产品本身有很多部分就是 Dots 写的。 4. 上线范围和企业用的 Specialist Dots Dots 和 Space 当天向 ChatGPT Pro、Business Premium 和 Enterprise 用户开放。Dot 包含在套餐里,和它的对话不占用额度。 企业客户还可以预览 Specialist Dots。这是由公司统一设置、供整个团队使用的虚拟同事,负责会计、市场、法务这类工作量大的事。公司给它目标和背景,审核它的产出,给它反馈,反馈在全公司共享。OpenAI 也在和微软合作,把 Specialist Dots 接入 Agent 365(微软用来管理企业智能体的工具),企业可以用已经在用的微软工具来管理它们。 5. 新模型:更便宜的 GPT-6.1 Sol,更快的 UltraFast Astra 发布这几周,用户的要求集中在两点:更便宜,更快。GPT-6.1 Sol(转录稿误作 Soul)的能力接近 Astra,价格是它的五分之一。缓存输入(重复发送、已被缓存的上下文)比标准输入便宜 95%。智能体需要反复读同一批上下文、长时间迭代,这对它们尤其省钱。Sam 说 Sol 在某些方面比 Astra 还聪明,定位是开发者的日常主力模型。 UltraFast 是新的速度档,API、ChatGPT 和 Codex 里都能用。原有的 Fast 档是两倍速度、两倍价格;UltraFast 是八倍速度、六倍价格,每秒 300 个 Token。它现在可以配合 Astra 用,之后也会支持 Sol。现场让两个模型用同一个提示词,做一个 DevDay 配色的火箭。UltraFast 的火箭已经升空时,标准速度的还没做完。 订阅也跟着调整。新推出的 500 美元档 Pro 订阅叫 Pro 500,额度最高,是 Plus 的 25 倍。它可以在 ChatGPT 和 Codex 里用 UltraFast,还能通过“用 ChatGPT 登录”在合作方的应用里使用。Pro 200 重新开放,继续提供所有前沿模型。 另外预览了 Decisions API。它给 Luna 模型一组预先定义好的选项,让模型从中选一个,比如给请求分流、给图片分类、决定智能体下一步做什么。任务收窄成选择题之后,响应时间可以压到一秒以内,同时保留图像理解、多语言和安全防护。Romain 后来补充说,做机器人的朋友看中的是它能处理视觉输入:机器人可以根据看到的东西,近乎实时地快速行动。 6. 模型开始帮 OpenAI 做研究 Sam 提到,去年这个时候,他和 Jakob 在一次直播里预测,一年内会出现第一个“AI 研究实习生”,当时几乎没人相信。几周前 OpenAI 宣布达成了这个目标:有了一个能接手定义清晰的研究任务的系统,这类任务原本要熟练的研究员花大量时间和精力。 Tejal 的方向是电脑操作(computer use,让模型像人一样操作桌面和浏览器)。她举了两个例子。 第一个是让模型优化电脑操作的运行框架(harness,包在模型外面、负责调用工具和管理步骤的代码)。模型在循环里持续寻找能同时降低延迟、提升效果的改动,团队把找到的改进合进生产环境的框架,并用于后训练。结果是延迟改善了两倍以上,已经上线。 第二个是模型帮忙改进了监控和拒绝训练,让 Astra 在不安全的场景里更会拒绝。Astra 在电脑操作压力测试上因此达到业内领先,操作时出错更少,也更贴合用户的本意。 她给出了几项内部数据。今年夏天之后,研究工作消耗的 Token 量急剧上升。1 月时,模型能做好 15 分钟以内的短任务,需要一天以上的任务大多会失败;到 7 月,超过三分之一的一天量级研究任务,模型能在无人干预下完成。她还提到,Astra 这类模型已经帮忙解决了 100 多个悬而未决几十年的数学问题,也在参与针对耐药感染的新抗生素、古代语言研究、可再生能源和工业机器人等方向的工作。 7. 给开发者的底层工具 Sam 说,OpenAI 想让开发者用上自己内部用的东西。 第一件是 Codex 的运行框架。它同时支撑着 Codex、ChatGPT Work 和 Dots,目标是用最少的 Token、最快拿到准确结果,现在已经开源。第二件是 Codex 完全上云:在手机上开始的任务,可以在浏览器或桌面端接着做,合上笔记本任务也不会中断。 云端能力带来了 Codex Security Cloud。它在��端环境里持续寻找漏洞,并准备好验证过的修复方案供人审核,这次新增了自动去重、定时扫描和新界面。Sam 说这是为了给防守方更好的工具,因为“我们看得到接下来会发生什么”。 新的 Agents API 进入公开测试。它包含运行框架、托管、记忆、多智能体控制等功能,是 Codex 和 Dots 用的同一套技术,也加入了电脑操作能力。现场的例子是一个网站测试智能体,会自己打开浏览器、点击页面、测试流程。基础设施方面,OpenAI 和 AWS 合作推出由 OpenAI 驱动的 Bedrock(AWS 的托管 AI 服务)托管智能体,AWS 客户可以直接使用 OpenAI 的前沿模型、Codex 和 ChatGPT Work。 隐私方面预览了 OpenAI Private Intelligence。其中的零数据留存(ZDR)配合私有安全处理,可以在不把用户内容存到 OpenAI 服务器的情况下做安全检测;私有推理则把隐私保护延伸到推理阶段。Sam 说这套方案是和最大的一批客户一起设计的,目的是让他们能把模型用在最敏感的工作上。 性能方面,Responses API 一年里增长了 100 倍,可靠性保持在 99% 以上。首个 Token 的等待时间缩短了 45%,工具调用和工作流提速 30% 以上。 8. Romain 的 Codex 演示 演示从手机上的 Codex 开始。Romain 人还在会场外,让 Codex 替他跟观众打招呼、讲一个会场的冷知识。接着他用几张会场照片生成的 3D 场景演示 UltraFast,一边说一边改:把小人放到座位上,把直播画面投到场景里的大屏幕上。现场语音没连上,他改成了打字。 Codex 命令行工具(CLI)这次全面翻新。他让 UltraFast 写一个应用,从观众里随机抽三个人送明年的门票,几秒就写完;改成抽六个人,也几乎是瞬间完成。命令行现在支持由 GPT Live 驱动的双向实时语音,不只是语音转文字,但现场没能演示出来。 后面几段演示了多模态和电脑操作。游戏 Astra Adventures 从一张纸上的草图开始,几轮之后画面还很粗糙,借助图像模型,才变成有质感、能用在正式游戏里的美术。然后他让 Astra 通过浏览器自己学着玩这个游戏,屏幕左边显示模型的决策,右边显示它按下的按键。 他又用“应用快照”(app shot)把自己记录飞行课程的应用作为上下文交给 Codex,让它在各种屏幕尺寸下审查这个应用并截图。Codex 自己在模拟器里点开了各项功能。云端 Codex 现在和本地版用同样的工具,包括插件和电脑操作。他顺手把一个“用 Rust 重写整个后端”的任务丢到云端,打算稍后在手机上查看。 最后一个演示用的是 Hugging Face 借来的可编程小机器人 Micro Duck,它名叫 Lavender。Romain 前一晚让 Codex 把它接好:视觉用 Astra,图像生成用 GPT Image 2.5,语音交互用 GPT Live 1。机器人现场看着观众画了一幅画。他说,OpenAI 做 Dots 和 Codex 用的,就是 API 里开放给开发者的同一批工具。 9. 分发和变现:让开发者在 ChatGPT 上做生意 ChatGPT 每周大约有 12 亿人使用。Sam 承认,此前类似的尝试效果参差不齐。他说这次有信心,是因为开发者拿到的是 OpenAI 自己做 ChatGPT 用的工具。 第一项是“用 ChatGPT 登录”(Sign in with ChatGPT)。用户登录第三方应用时,可以直接用自己 ChatGPT 套餐里包含的 Token,开发者不必替新用户垫付模型费用。首批有 16 家合作方。 第二项是插件扩展(plugin extensions)。开发者可以把编辑器、仪表盘乃至整个工作区,做成原生嵌在 ChatGPT 和 Codex 里的应用。现场展示了三个例子。一个是会议应用:在 ChatGPT 里看日历上的会议,点“记笔记”后,页面变成团队和 Dots 一起跟进待办的 Space。一个是 Figma:打开设计稿、看团队评论、让 ChatGPT 改稿。还有一个是 Adobe:在 ChatGPT 里使用 Photoshop 的功能。ChatGPT sites(在 ChatGPT 里生成的网站,几个月里已有数百万个)现在也能接入插件和数据。访客用自己的账号登录、带上自己的智能体,看到的内容因人而异。 用户发现插件的渠道也扩大了。除了在插件库里搜索,ChatGPT 还会在对话中识别出能帮上忙的插件,用户当场就能连接。插件审核流程也简化了:开发者可以跟踪审核进度,看到需要修改的地方,申请人工复审,更新工具时也不用从���提交。 第三项是 OpenAI Marketplace,首批有 30 多家合作方,包括 CodeRabbit、Notion、Vercel。企业客户可以用已经和 OpenAI 签下的采购承诺额度来买这些产品,有承诺额度的开发者也能在这里花。通过和模型推理托管公司 Baseten(转录稿写作 Base10)合作,市场里还能用到开源模型。 10. 收尾:一次额度重置,和“文艺复兴”的说法 当天的后续安排里,Peter 会讲 OpenAI 对开源社区的投入,包括新的 OpenClaw Enterprise Harness(OpenClaw 是一个开源 AI 智能体项目)。还有一个 Codex 游戏工作室环节,观众可以用 Codex 做复古游戏,每人能领一台 DevDay 限定的 chromatic computer,用来玩自己做的游戏。最后是 Sam、Tibo (Thibault) 和 Tejal 的现场问答。 Sam 和 Tibo 还在台上按下按钮,给全世界的用户重置了一次用量额度。Sam 说 OpenAI 已经做过太多次重置,Tibo 一直想把公司改名叫“重置公司”。 最后 Sam 说,他不喜欢把 AI 比作新一轮工业革命,那意味着人变成巨大机器里的齿轮,转得越来越快;生活里有些部分不能也不该被自动化。他希望,如果做对了,AI 带来的会更像一场新的文艺复兴:让人对自己的生活有更多掌控,有更多工具去创造、学习和探索。
16
12.4万 followers
Views4.4K
OpenAI 发布全天候个人Agent: Dots: 由 GPT-6 Astra 驱动 - Dots 会主动自主推进事情,遇到关键节点才找你批准 - 它可以同时管理你的工作和家庭事物 - 它不只汇报进度,出了问题会主动想办法补救 同一个 Agent 既改董事会稿、跑代码上线,也订蛋糕、报课后班、协调女儿演出的时间冲突。 它是你的"私人管家",而不是"效率工具"...
18Views4.4K
OpenAI 今天发布新 Agent:Dots。 然后网友发现一个很离谱的细节: 输入 https://t.co/rEDNE6lfRq,现在会直接跳到 Grok Bot。😂 但先别急着说“马斯克抢注了域名”。 我查了下,https://t.co/rEDNE6lfRq 早在 1994 年就注册了,现在 WHOIS 也是隐私保护,公开信息根本无法确认背后持有人是谁。 所以目前唯一能确认的是: OpenAI 发布 Dots 的当天,https://t.co/rEDNE6lfRq 的流量入口却指向了竞争对手。 是提前布局、临时改跳转,还是单纯巧合,现在还不知道。 但作为一个产品发布乌龙,节目效果确实拉满了。 不信你点进去看看👀
19Views4.2K
就 meta 今天的股价表现,市场已经给出答案了,openai 的 dot 完全无法跟 muse 抗衡。目前来看能打败 muse 的只能是谷歌了。 我给谷歌的建议: 1.做美国的 deepseek,仗着家大业大卷死他们。 2.尽快推出基于安卓生态的个人智能体,要快!立刻马上! 3.必须推出 Gemini 的专属硬件产品,眼镜也好,音箱也罢,摄像头也行,哪怕一个灯泡都可以,但必须要有硬件! 4.去舔苹果,和苹果绑死… 5.模型基础能力追上第一梯队就行,别垫底了。 6. Antigravity 改个名字吧… Buy the dip,长期持有,Discord在个人资料。
24
25.1万 followers
Views2.7K
OpenAI 发布 GPT-6.1 Sol:能力接近自家旗舰 Astra,价格只要五分之一 OpenAI 推出了中端模型 GPT-6.1 Sol,官方说法是“接近 Astra 的智能,五分之一的价格”。GPT-6 Astra 是 OpenAI 目前最强的模型,Sol 则是它下面一档、主打性价比的系列。 先看价格。API 上,GPT-6.1 Sol 每百万 token 输入 2 美元、输出 10 美元,Astra 是 10 美元和 50 美元,正好差五倍。重复使用的内容(比如每次都要带上的系统提示词、长文档)走缓存,每百万 token 只要 0.1 美元,比 GPT-6 Sol 的缓存价又便宜了一半。 对开发者来说,这意味着以前只敢在关键环节调用 Astra 的应用,现在可以把更多请求交给 Sol,账单能明显降下来。 能力上,这次升级主要在三块:写代码、操作电脑、处理复杂的专业工作。按官方数据,在软件工程测试 DeepSWE 上它追平了 Astra;在衡量“让 AI 自己操作电脑完成任务”的 OSWorld 2.0 上,比上一代 Sol 提高约 7 个百分点,离 Astra 只差约 2 个百分点。回答事实类问题时的出错率也从上一代的 11.4% 降到了 7.7%。 OpenAI 还特别提到,新模型更愿意坦白自己做不到什么,也更守规矩,不容易偏离用户意图或越过安全限制,这方面向 Astra 看齐。 现在就能用:ChatGPT 的 Plus、Pro、Business、Enterprise 和 Edu 用户可以在 ChatGPT Work 和 Codex 里直接选用,开发者在 API 里调用 gpt-6.1-sol。官方还预告了一个生成速度最高快 8 倍的极速版,稍后上线。
29
10.7万 followers
Views0
OpenAI 给 Pro 会员送了个 24 小时干活的 AI 员工😳 它叫 dots,Codex 负责人 Tibo 刚发的,就是一个一直在线、替你干活的 agent 它有自己的电脑和浏览器,能连 4000 多个应用 你给它反馈它会学,它干活的时候你也能随时叫它 最关键的是它不扣额度,而且跑的是他们最强的模型 Astra,包含在 Pro 里,不占你的用量 昨天他刚说新的 200 刀 Pro 按 API 价算只值老版一半,也说过今天会加不占额度的东西,看起来就是这个 今天先给每人一个主 dot,之后能组一整队 评论区有人在问 Plus 怎么没有,原推只提了 Pro Pro 按 API 价缩水一半,换来一个 24 小时干活的 AI 员工,这笔账你觉得划算吗?
30
5.9K followers
Views0
GPT-6 Sol 上周才发,今天 OpenAI 就把它升级成了 GPT-6.1 Sol。价格一分没涨,还是每百万 token 输入 2 美元、输出 10 美元,复杂编程却已经追平 Astra 了。 官方数据显示,在 DeepSWE v1.1(真实代码库里的复杂软件工程任务)上,6.1 Sol 和 GPT-6 Astra 打平,成本只有大约五分之一。它用更低的推理强度,就比 6 Sol 的最好成绩高出 6.4 个百分点。computer use 也明显变强,在 OSWorld 2.0 离线集上,最高推理强度下比 6 Sol 高 7 个百分点,成本还不到一半。 API 里已经可以用 gpt-6.1-sol,ChatGPT Work 和 Codex 从今天起对 Plus 及以上用户开放,普通聊天暂时还没有。 我感觉 Astra 的位置有点尴尬了。大部分写代码和跑 agent 的活,先用 6.1 Sol 就够,真卡住了再切 Astra。
32
5.9K followers
Views0
合上电脑 Codex 还在云端跑,dots 24 小时在自己的电脑上干活,放在 Pro 里还不扣额度。OpenAI 今天 DevDay 发了 20 多样东西,基本都在做同一件事,让 AI 在你不在的时候接着干。代码审查会趁你不在先过一遍,插件能在看板上一出现新任务就自己读文档、起草计划。它卖的已经不是一个更聪明的聊天框了。 新模型、dots、Codex 更新和 500 刀的新 Pro,下面一条条说。
34
5.9K followers
Views0
OpenAI 刚在 DevDay 发了 Dots,我第一反应是这不就是 OpenAI 版的 Grok bot。 以前用 ChatGPT 得先打开 App 再跟它聊,Dots 更像通讯录里多了一个联系人。你可以给它发短信、打电话、在 Slack 里找它、给它发邮件,它就在你本来就在用的地方回你。每个 Dot 跑在自己的一台电脑上,一直在线,要花钱买东西会先等你批准,还能给它捏一个 3D 形象。 Dots 直接住进你所有的沟通渠道。
personal agent最后很大概率又成了剃头挑子一头热。 因为绝大多数消费用户都用过了chatgpt、豆包、claude,能做的工作基本已经覆盖了,何况chatgpt和claude内部500年前就给你提供了一个受限container用了, 绝大多数用户如果有额外专业需求,早就想办法用claude code或者chatgpt(codex)来工作了。 personal agent最终还是浪费非常多的token,来满足消费用户的一些非常浅薄无知的小白功能,比如问个药,问个路,推荐个菜馆,最终发现给你一个类似manus的环境和一堆丰富的container,你还是拿他来当大豆包来用。 openclaw已经帮所有人试错过一次了,绝大多数所谓的非CS民办三本文科傻逼们安装完了以后,能想到的最大的用途,就是到处抄文章、搜热点、洗稿、发布洗稿文章。