
Back to topic rankings这把营销操作真心可以。。。
翻译成中文就是:
从今天起,只要你的 ChatGPT 付费订阅账户尚未获得 Astra 的使用权限,每耽搁一天,我们就会补偿一次可累积的额度重置机会。团队正在全力以赴,争取以最快速度为大家开放权限。
第一笔重置额度将在大约 3 小时后发放到账。如果你还没有账号,现在注册还来得及。
哇,这个要点赞,在 GPT-6 Astra 能使用之前,Codex 每天送一次重置机会,这个是可以累积的,你可以自己选什么时候用就什么时候用。不过没说这个有效期,至少应该一个月吧。
首次重置额度将在大约 3 小时后到账。如果还没有账号,现在注册也还来得及。 老实说,看完 GPT6 的介绍并没有感到很惊艳
为什么感觉不到 AGI? OpenAI Astra如期发布,有幸体验到了首发版接口,聊聊我的看法和一手体验。我认为这是第一次真正跨过了“能用”的临界点
我能感受到几年在预训练、强化学习和后训练上的积累,终于开始汇聚到同一个系统里
我用ai做投研很久了,reasoning、coding、computer use、tool use 和长任务,以前这些能力各自都很惊艳,但一串起来就容易崩:网页打不开、数字抄错、执行到一半忘了最初目标,最后还是人类接管
Astra 给我的感觉第一次不太一样。
我专门拿了一个很贴近我平时工作流的任务测试它:同时研究三家刚发财报的 AI 芯片/互联公司 $MRVL $CRDO $AVGO
只给了公司名字和一个问题:
为什么三家公司都在讲 AI demand 很强,但盘后市场却同时惩罚它们?到底是哪几个数字出了问题?
它自己去 IR 页面找 earnings release、10-Q、电话会 transcript,再把 revenue、AI revenue、guide、design win、客户时间线等数据拉出来做成表。
中间有一个数字在新闻稿和电话会口径里不完全一样,它没有直接选一个数字继续写,而是重新打开原文,找到管理层解释这个数字对应的时间周期,然后回来修改自己的结论。
我做到一半临时改要求:
“不要再讲宏观,把所有跟 Google / AWS custom silicon、互联和光通信有关的东西单独拆出来,再解释这三家公司之间到底是不是份额转移。”
以前的 Agent 很容易从头再来,或者把之前的信息忘掉。Astra 是在原来的 research tree 上重新规划:保留已经验证的数据,补新的资料,再修改 thesis。
那个体验很微妙,和之前的opus5和GPT5.6都不太一样
我第一次不是在不停地 prompt 一个模型,而是在 review 一个 junior researcher 的工作。
intelligence × agency × reliability都有了显著提升,这是一个我敢把���天的活交给它做的模型。静候全量继续使用 好消息:GPT-6 Astra 正式发布,能力飙升,电脑操作能力断档领先!
坏消息:目前只向组织客户开放,甚至连 Pro20×都没资格使用。。。我特喵的!!!😡只能先看一些社区爆料信息解解瘾!
上下文 1.05M,最大输出长度 128K, 价格方面直接和 Fable5.1 打平,每百万输入 10 美金,输出 50 美金。
最让我感到兴奋的是 Astra 直接操作电脑的能力,也就是 Computer use 的成功率得到巨额提升,而且速度快了一倍!
去操作 Word、剪映、AE、PS、 测试软件、读取控制台报错……可以说,以后可能不需要各大软件开放 API,Astra 直接像人类一样操作就完事了!对法律、剪辑等领域的影响显著。。。
还有一个在 Codex 里面很惊艳的一点,Astra 的主观判断性加强,可以边问边做!
如果涉及到需要用户补充信息,他会弹出一个问题窗口,自己还在干一些不需要补充信息的任务,不会像之前一样就傻傻等着。
在长任务上也很爽!以前自动压缩可能会把之前的一些要求压缩没了,如果不加深度链接,也不会跨窗口搜索信息。
但现在它会主动跨窗口查找相关信息,也可以搜索更早的工具输出,目前在 config.toml 主动打开,未来几周会变成默认选项。 假如GPT-6 Astra真的强到能替代人类工作
当智力不再是稀缺资源,会发生什么呢? OpenAI 今天凌晨公布了全新架构的 GPT-6 Astra 群星
但最让人欣慰的是,人类终于不再卷 coding,去瞄准科学的星辰大海了
OpenAI 内部将其视为第一个 AGI 时代的模型
这个模型在科学研究和抽象推理方面大幅提升
而且这个模型的智力模式非常特别
相比其他模型,可以大幅减少推理步骤,以更少 Token 获得更高智能
但这个模型在 coding 方面却进步很小,不如 Fable
价格方面 10in 50out,也对齐 Fable/Mythos
也许从外界看来,Mythos 可能是第一个 AGI 时代的模型吧,不过我们没资格用 Mythos,无法评价了
科学
Terminal-Bench Science 0.1(科研终端与管线自主操作):从上一代 Sol 的22.4% 暴涨至 64.6%(大幅领先 Fable 5.1 的 52.6%)。
FrontierMath Tier 4 (v2)(前沿科研级数学):达到97.6%。
真实数学发现:协助数学家 Julia Stadlmann 将素数间隔(prime number gaps)上界从 240 推进到 186;推动了一项维持 80 多年未动的数学界��。
智能与效能
动作与步数效率(ARC-AGI-3):在96% 的关卡中,摸索并解出未知机制所用的动作步骤比人类中位数还要少,平均动作数减少 51.7%。它不再靠暴力穷举,而是在上下文里现场发明代数简记法(DSL)压缩状态。
任务级能效比(Cost-per-task):虽然每百万 token 单价更贵,但在 OSWorld 2.0 等长流程复杂任务上,单任务耗时从 75 分钟压到了 40 分钟左右,总消耗 token 显著减少。
工程
专业工业软件(BenchCAD):达到95.9%(领先 Fable 5.1 的 84.3%),直接落地 KiCad(PCB 电路设计)、Unity 3D 排布和金融建模(Financial Modeling World Cup)。
编程
DeepSWE v1.1(真实软件工程能力):Astra 得分为74.1%,对标 Claude Opus 5 的 74.0%、Gemini 3.8 Flash 的 73.7%,甚至低于 Meta Muse Spark 1.3 的 75.4%。基本和大家挤在同一个平台期,完全没有拉开代际差距。
Artificial Analysis (AA) 综合智能与智能体指数:Astra 仅拿到了61.2 分,几乎与上一代 GPT-5.6 Sol(61分左右)持平,在 Coding Agent 指数上未见断层提升。
完整模型介绍在官网,写的非常专业,直接看一首信息,不需要看三方解读,可以在此详细阅读
https://t.co/u5ezSCSduE
在 GTA6 的开发期间 GPT 出了 1-6 在Anthropic准备上市前,两家labs互丢“法宝”互相斗法开始了 我已经想好拿到 Astra 后第一个交给它的任务是什么了:
请解决哥德巴赫猜想
你们谁都不要和我抢哈~ OpenAI推出GPT-6 Astra模型,称之为世界上最智能且最对齐的模型,在FrontierMath Tier 4、ARC-AGI 3 和 TerminalBench-4.0 上处于最先进水平。
目前Astra仅向有限的组织推出,几天内向所有ChatGPT Plus、Pro、Business和Enterprise用户开放。
https://t.co/e1hFbUHLeP https://t.co/eZZFq7IlJr Claude Code 总给我一种感觉:“你们这些卑贱的用户,赶紧求着我把智能放给你!”
Codex 是:很抱歉我们没有 deliver 最好的模型,因此重置了额度,谢谢你的使用
还没有用上 Astra 的朋友有福了,Codex 又会把额度重置,并且 Astra 晚一天发布就会多重置一天
归根结底,还是OpenAI 拥有的算力多。真的有人还在质疑甲骨文到底能不能 deliver 算力,以及会不会临时变卦吗?
我觉得大可不必担心了,值得恭喜大家在下跌到 114 的时候大胆抄底,下跌区间我也抄底了很多。现在如果把 AI比作一块蛋糕,我们连蛋糕胚都还没烤完 我勒个去?这是不过了…
这意思 每天给付费用户重置一次Codex 额度嘛?
只要用户还不能使用GPT-6 Astra模型,今天在3 小时内重置…… 紧急羊毛来了,现在每注册一个 OpenAI 账号,相当于白捡 n x Astra 周配额 (50 美元),成本一个邮箱 + 一条短信。理论上8美元的 Go 应该就能领到。 https://t.co/IZxLlgA9kn
无将竞猜:请问今天是哪个因素让我又起这么早?
1、娃
2、GPT 6 今天codex送重置次数
望周知 https://t.co/1PCHi8UNOY
GPT 6发布了,看评分是飞跃式提升,但是看提前体验的人的反馈,怎么都是做3D场景或者模型?
是不是AGI得实际用到再评价,我感觉叫AGI有点鲁莽了。 你现在最正确的事情,就是去开一个能用 Codex 的 ChatGPT 付费账号,然后等 OpenAI 给你发补偿。
因为Tibo 刚宣布:从今天开始,只要你的付费 ChatGPT 账号还没有拿到 Astra,每多等一天,OpenAI 就会给你存一次 Astra 的额度重置。
也就是说,Astra 还没排到你,额度已经开始给你攒了。
第一批 reset 大概 3 小时后到账,现在注册甚至还来得及。
OpenAI 这次为了缓解排队是真下血本了:晚一天拿到 Astra,就多送一次额度重置。
模型还没用上,羊毛先薅起来了。 价格也很有意思。
GPT‑6 Astra 和 Claude Fable 5.1 的 API 完全同价,都是每百万 tokens 输入 $10、输出 $50。GPT‑5.6 Sol 当前是 $4/$20,所以 Astra 和 Fable 的单价都是 Sol 的 2.5 倍。
订阅档位也几乎一样,ChatGPT Pro 和 Claude Max 都有 $100 的 5x 与 $200 的 20x。
Work/Codex 的 Astra 本地消息估算分别为 Plus 3–30、Pro 5x 15–150、Pro 20x 60–600 条/5小时。
Anthropic 没有公布 Fable 5.1 的固定消息数。Claude Max 最多可以把每周总额度的 50% 用在 Fable 上,而且 Fable 消耗额度更快。
Sol 继续作为日常默认模型。Astra 和 Fable 5.1 都定位在最高难度的任务。 AGI is here now ✨ https://t.co/JfsMjp3UxB
今天有个做算法的朋友发消息给我说,这是他入行以来最沸腾的一周。
昨晚GPT-6刚发布,把所有摸鱼时间都砸进去刷评测,仿佛转眼就摸到了AGI的门槛。
通稿到处都是,随便刷个首页都在喊奇点降临,只要扫一眼标题就够聊一下午。
今早在中关村软件园走路,大街上突然所有人停下手头的事,对着手机互相转发欢呼。
他说很兴奋,有种AI黄金时代的错觉。 看来 Pro 还是能先用上 GPT-6 Astra OpenAI 把 GPT‑6 Astra 的权限分得非常碎。
Plus 的普通 Chat 没有 Astra,最高是 GPT‑5.6 Sol 的 Medium / High。不过等 rollout 到账号后,Plus 可以在 Work 和 Codex 里获得有限的 Astra 用量。
Pro 的普通 Chat 可以使用 Astra,模型名是 GPT‑6 Pro,但有明确限额:
Pro $100:GPT‑6 Pro 和 GPT‑5.6 Sol Pro 共用 50 条/周。
Pro $200:GPT‑6 Pro 200 条/周,Sol Pro 另有 170 条/天,两者合计最多 200 条/天。
普通 Chat 的额度与 Work/Codex 分开,Work 和 Codex 共用同一池额度。Astra 的消耗也明显高于 Sol。
所以日常使用依旧是 GPT‑5.6 Sol,Astra 只能留给真正困难的任务。 看到GPT-6 Astra发布之后,作为一个博主很激动。
但写完稿子以后,躺在床上久久不能入眠。
作为一家30多个人的公司的企业管理者,这个时候却又会很真实的焦虑。
我怕这个时代太快,我们的团队、我们的组织跟不上。
只能尽可能向大家表达我的想法、还有我的认知。
尽可能让我们的小伙伴,更加的AI Native一点。
也尽可能,希望能带着大家一起走向那个伟大航线。
常常感叹,真是一个动荡的大时代啊。
我猜测 GPT 6 Astra的编程能力不会有大提升
大家好 我是刘小排。
早上刚醒就被GPT-6 Astra刷屏了。
根据小道消息,GPT-6 很是今年内将会发布的尺寸最大的一个模型。我相当的期待。
我目前还没有用上。 不过我有一些猜测,先写到这里,等我们用上的时候,可以再回来看看猜的对不对。
❶ 我猜测:GPT-6 Astra的编程能力不会有肉眼可见的大幅提升
理由是这样的:在目前大模型编程能力的排行上,你会发现有多种尺寸的模型几乎在同一个水平线。最极端的案例是GLM 5.3 vs Fable 5.1,它俩的编程能力的差别在百分之个位数,而模型尺寸的差别是10倍。
那我们很容易得出一个推论:只靠提升模型尺寸对编程能力的提升会非常有限。
❷ 我猜测:GPT-6 Astra的科研能力会大幅领先其他模型
和上一条的理由一样,我注意到,不同尺寸的模型在 AI for science的能力差异是显著的。
❸ 我猜测:GPT-6 Astra 的Computer Use 能力会大幅领先其他模型
原因:相信大家都看新闻了,OpenAI 这家公司前段时间买了海量的民用级别Mac电脑。我猜它是买来训练模型的Computer Use 能力的。
此外,从原理上讲,Computer Use能力要求模型直面真实世界而不再是“小镇做题家”,这会直接挑战模型的所谓“世界知识”,尺寸越大的模型越占优。
❹ 所有的现存头部测评榜单(包括 Artificial Analytics)都会失效,直到发明出新一代的测评算法。
在新一代的测评算法被发明出来之前,在今年余下的日子里,大家要分辨头部前沿模型的能力,只能看自己的体感和一线实操者的体感了。
也欢迎你在评论区说说你的看法。
对了对了!再补一条预告:今天上午 10 点(马上到了),要么你能直接用上 GPT-6,要么你会得到一个 Codex 的重置卡。我义父 Tibo 说的。截图见评论区。 GPT-6 Astra 来了!
可能会比 GPT-4 → GPT-5 的升级更具有时代意义。因为 OpenAI 在试图把 AI 从“会回答问题的模型”,推到“能够独立完成现实世界复杂工作的智能体”。
真正走向能干活的 Agent 的重要一步!
我觉得得可以把过去几代 AI 简单理解成:
GPT-3:会写
↓
GPT-4:会理解和推理
↓
GPT-5.x:会深度思考 + 使用工具
↓
GPT-6 Astra:开始真正「干活 + 自主研究」。
所以GPT-6 最大的亮点和里程碑我认为是这几个:
① ARC-AGI-3 7.8% → 99.9%:未知任务的抽象推理能力出现巨大跃迁。
② AI 开始参与产生真实的新数学结果:从“知识消费者”走向“知识生产者”。
③ Computer Use + Agent 能力成熟:从“回答你的问题”进入“替你完成工作”。 GPT 6 Astra 发布,但是还不能用。这可能是个好事,因为每推迟一天,他们就会送一次重置。
由于这次架构的变化,以及他们想直接给所有的付费用户(Plus 也会有权限),并且所有人都可以将额度 100% 用于 GPT-6 Astra。
所以有很多新的系统需要部署,没办法同一时间上线。他们送的重置次数是可以存起来的,而不是立刻重置。
回到 GPT-6 Astra,从目前公布的一些演示来看,这个模型在任务持续时长上非常恐怖:
比如有人让它给小米 17 Ultra 做一个 ROM(也就是系统),它持续运行了 8 天,调用了超过 1600 个 sub-agent。
另一个特点是,它在 3D 建模和渲染上的能力非常强。
它几乎可以所见即所得地把你给它的图片在 Blender 里从零开始建模,构建整个环境并渲染出来。所以在虚幻 5 或者 Unity 里做 3D 游戏也非常厉害。
我觉得这对于 3D 生成模型和视频模型来说,是一次非常重大的打击。
在成本方面:
价格上,它的定价是 5.6 的 2.5 倍,缓存读取享有 90% 的折扣。
同样的任务它消耗的 token 数量只有 Claude Opus 5 的 1/5,不到 Claude Fable 5 一半的成本就可以得到跟它一样的得分。 没想到真的来了,这次没有跳票。OpenAI 于深夜发布新一代旗舰模型 GPT 6 Astra,官方定位为当前全球最好的 AI 模型!
它的核心卖点不是单纯问答更强,而是能直接替你操作电脑,浏览网页、写代码、做 PPT、构建项目,而且更快、更稳、更少跑偏。
同时这代特别强调 Astra 是最对齐的一代,更理解用户意图,更少越权、更少单独跳过用户的需求额外行动。
例如同一件事,它往往更少绕弯,也更懂你到底想要什么。如中途改需求,它仍能记得原目标。
不过该版本,对用户也会有限制,因为它被确认在网络安全这类能力上非常强,强到官方自己按安全框架,都标成了高风险档。
所以之前市面期待的网络攻防能力,暂时不会向用户开放,仅先给部分机构和付费用户。
而这次各类的测试、API 花费,OpenAI 也是全方位拿 Claude Fable 5.1 进行对比,各项指标 GPT 6 Astra 均领先。

我们真的要进入AGI时代了嘛?
AIControversialAll-time data
GPT-6 Astra额度补偿与API定价讨论
GPT-6 Astra 发布后的讨论继续集中在账号权限、额度补偿和 API 价格上。Vonng 称注册 OpenAI 账号可能获得 Astra 周配额,引发“羊毛”式使用策略讨论;Max For AI 转述 Tibo 说法,称付费 ChatGPT 账号未拿到 Astra 时可能按等待天数累积额度重置;KC 对比 GPT-6 Astra、Claude Fable 5.1 与 GPT-5.6 Sol 的 API 单价;BITWU 则把 Astra 解读为 OpenAI 从问答模型走向能独立完成复杂工作的 Agent 的一步。相关说法多来自用户转述和解读,具体规则仍需以官方说明为准。
#GPT-6 Astra#OpenAI#Codex#API定价#额度补偿
Topic heat
660
Posts
29
Views
45.9万
Creators
23
Topic trend
From first appearance to last update, with a seven-day minimum window.
All related posts
29 posts in total
































