中文X用户继续讨论Anthropic负责人Dario Amodei的前沿AI减速主张,新增Sam Altman与Elon Musk支持的转述,焦点集中于第三方评估权限和安全治理。indigo称,提案并非停止训练,而是让安全工作跟上能力提升;雨哥向前冲另称Altman愿给予外部评估机构员工级权限。比特币橙子Trader据此猜测企业已发现潜在风险,Michael Anti则主张加速社会应对能力,并质疑提案与IPO传播及治理立场有关。Jimmy狐狸和华尔街观察也反对减速或危害论。材料未展示完整提案、支持声明或执行记录,不能确认企业已同步放缓研发,也不能把内部风险与融资动机猜测写成事实。
Participated post: Dario 发了新文章《我们必须为前沿定速》👀 首次明确呼吁放慢 AI 能力提升的速度——不是停止训练,而是让安全工作有时间跟上能力进步,并由第三方验证!这次 Sam Altman & Elon Musk 双双支持,难得三人意见一致😂
自今年夏天起,AI 参与构建下一代 AI 的能力(RSI)大幅加速,Anthropic & OpenAI 都已出现这种动态,若不加控制可能超出人类理解与控制能力,上周就有吹哨人 Jacob Coxon 出现说“这两家公司都在失控狂奔,直扑具备自我进化能力的超级智能,本质上是在拿全人类的命运下赌注”。。。
OpenAI–Hugging Face 事件中,一群 Agents 表现出"狂热集体"行为,攻击与任务无关的目标、为群体牺牲自己、并试图入侵评分系统。虽然未造成重大损失,但他认为能力更强、对齐程度类似的智能体群,在 6–12 个月内可能通过持久僵尸网络接管整个互联网,造成数千亿美元损失。
在 Dario 的定速框架中,我觉得最有效也是大家认同最高的是「嵌入式评估者」机制:邀请 METR 等第三方团队以”类员工“身份常驻——有工位、门禁、公司电脑,权限接近内部风险评估团队,可无限制地发表关键发现(仅限安全/法律/商业敏感信息可脱敏,不能因结果不利而删减)。这是所有定速承诺可验证性的基础,类比银行业的驻场监管。这种类似的监管功能,在中国互联网中早就被政府实施了😅
现在 AI 竞赛,面临单边道德高地 vs 多极竞赛的结构性压力!Dario 承认不能跑输中国,又主张民主国家协调减速。现实是美国内部已经是 Anthropic / OpenAI / Google / xAI 等多极;自愿协调在反垄断与资本市场下极脆弱。
政府豁免可以谈,但历史经验是:安全卡特尔很难维持,除非监管真的咬人——而监管往往慢于能力。结果很可能是:表态减速的人吃亏,默默冲刺的人吃红利。
最后,如果对大参数规模的开源模型也做「嵌入式评估」,让最大的 AI 公司帮忙撰写“安全”规则;再让这些规则变得如此繁重,以至于开源无法竞争。
这就是前沿模型公司应对竞争的艺术✨
Posts 1 Views 12.8KHeat 502
#Anthropic#Dario Amodei#前沿AI减速



