返回话题榜
AI利好全部数据

Claude与Codex双Agent协同落地:提示工程与开发工作流重塑

随着大模型在工程实践中的深入渗透,开发者社群围绕Claude与Codex的多智能体(Agent)实机协同以及系统提示词(System Prompt)优化展开密集落地实测。技术博主实操展示了利用Agent直接以Rust重写桌面硬件控制系统,并实现Claude与Codex双智能体工作状态与Token消耗的实时联动监控;与此同时,开发者结合业界前沿建议,积极引入ASD-STE100等标准化受控语言规范作为System Prompt,显著提升了大模型在复杂代码理解与架构设计中的精准度。讨论认为,从单纯向LLM问询代码到部署多Agent自主协同全流程,AI辅助编程正加速从单点工具迈向全链路自动化接管。

#Claude#Codex#双Agent协同#系统提示词#智能体开发
话题热度
1201
选题
帖子数
19
曝光
98.7万
参与创作者
13

话题热度趋势

从首次出现到最后更新;不足 7 天时补足 7 天观察窗。

全部关联帖子

共 19 条

1
1.6万 粉丝
曝光15.0万
Opus 5.5 是真香,Claude 号是真难养啊!兄弟们!!! 国庆第一天,我时间线上刷到的全是 Claude 封号:用了两年的老号说没就没,最高档订阅说封就封,连写防封教程的博主自己都中招了😂 偏偏这周 Codex 200 刀套餐同价降配,一堆人正准备转 Claude。 我前几天用云电脑注册的一个号,22 分钟就没了。 折腾了这么久,网上那些防封玄学我全扔了,只留真管用的 4 条claude防封指南: 一、真正管用的 4 条 1、固定,比"纯净"重要 设备和出口 IP 固定,比花钱买家宽有用。一个 VPN 里天天切节点,IP 照样在变。 2、一个号一个环境 被封过的浏览器别再登新号。顺手去 Settings → Account 看一眼 Active sessions,陌生登录先踢掉。 3、别上来就开 Max 新号 + 新卡 + 直接 20x,是风控眼里最显眼的样本。Free 用一阵,再 Pro,不够了再升 Max。 4、用量别天天顶格 新号开了 200 刀当天就用满,最容易出事。每周留点余量。 彩蛋:一个最玄的说法,信不信由你 Claude 会给账号算"价值":天天写代码、写文案的号最容易被封,常问前沿研究、数学、论文的号很少出事。 照这个说法,新号第一件事该是拿公开行业报告去问它,把自己养成"研究员号"。没法验证,但你的对话越有训练价值,它越舍不得封你,好像也说得通。 二、这 3 笔钱可以省 · 家宽 IP:大厂程序员走公司机房 IP 照样天天用。关键是稳定,不是标签。 · 时区、中文输入法:别折腾,影响没传得那么大。 · 老谷歌号:没依据,谷歌不会把账号年龄告诉 Anthropic。 付款也别乱选:官网刷卡被封不退款,App Store 至少能找苹果兜底。细节在付款篇。 三、你是不是非得自己养号? · 每天重度写代码、能把 Max 用满的:老老实实养官方号,订阅给的额度按量买不到。 · 偶尔用 Opus 5.5 干难活、怕封、团队要一起用的:走按量就行。 按量这块,我现在放在 Agent Space: Opus 5.5 是官方 API 价的一半(每百万 token $2/$10,官方 $4/$20),云端选 Claude Code 就能跑,不用注册 Claude 号。 注册就送 $1 体验额度,不用先充钱,拿 Opus 5.5 跑个小任务试试手感再说。 Codex 也在这,独立账号月付是官网的 5 折,年付 4.5 折。今天丢了一句话给它,几分钟做出配图里这个账单计算器。 最让我惦记的是:官网 Claude Code 订阅拼团那栏,已经挂上"即将上线"。 Codex 能打到 4.5 折,Claude 要是也照这个路子来…… Max 不用养号、不怕封、价格还砍一半多,那上面的防封攻略我可能白写了😂 上线那天我第一时间去测,想蹲的先关注。 Claude 系列前两篇: 网络篇:https://t.co/t6UUZKlCTV 付款篇:https://t.co/XnWaRsPB2F Agent Space 首购链接(多送 10% 额度): https://t.co/YBFJNC2cTY
3
4.8万 粉丝
曝光8.5万
Congrats to the Claude Code team on shipping Mods! A cute way to make your agent harness extensible and customizable. It's a nice convergence of ideas: in Claude Code, mods are just plugins; and @DeepSeekHarness has been built around rethinking the concept of plugins from the very beginning. While a subset of Claude Code features are made available as mods, in @DeepSeekHarness everything is a plugin: models, tools, skills, sessions, sandboxes, filesystems, loops, orchestration, and UI are ALL implemented as plugins, and can be mixed, matched, replaced, and extended. In @DeepSeekHarness's Creator Mode, you can prompt the agent to inspect the live runtime, write plugins, and persist them, in order to change the UI, modify agent-loop behavior and mechanisms, and add tools or new ways of orchestration — simply everything about the agent harness can be modified on the fly and persisted. So we've been thinking about the term https://t.co/iZMrTtTvrM for a while… Or should it be https://t.co/uK0yod3rht now? 😂
4曝光8.4万
过去一周多,可能以后被证明是AI推理部署史上天翻地覆的一周。 上个周末,我的本地机双5070ti试跑Qwen Flash,只能做到200 prefill,10decode。 今天,在Strata和我自制的PR的支持下,目前可以跑到2200/67,而且只需要一张卡。 即读写速度都提高了近十倍。 更好的消费卡比如4090/5090,当然也有幅度相当大的升级(目前5090在流式处理的支持下,速度已经开始逼近RTX6000,当然显存还是不足)。 这当然带来了消费级硬件的新一轮大涨价。如今,就连曾经无人问津的 32G B70英特尔显卡都卖断货涨价了。 2200/67的速度是什么意思? 今天除了deepseek,muse等少数模型,大部分API达不到这个速度。 而一个普通的家用游戏电脑就可以达到这个水平。 而这个水平,一周以前,只有5090,DGX spark,M3U这样的机器可以达到。 也就是说,在过去的一周多,全球的普通家用电脑带来了十倍于上周的AI产量。 这个增量,得益于deepseek- Qwen flash这种特殊设计,把智力分成了注意力,专家,和查表, 也得益于Strata这样优秀的架构,把整个处理流水线化,让不同的智力,存储在不同速度的存储设备中,在需要用时刚好抵达。 这对所有愿意拥有本地智力的人,当然是极大的利好。 也许模型层的设计,正在快速收敛到一个目前硬件条件下的最优解? 然而这对依赖出卖模型算力的生意,尤其是平庸的智力的商业来说,也可能是催命符。
5曝光7.3万
Tibo已经完全暴走了😂😂😂我猜他可能要领N+1了。 首先他暗示这次重置意味着dots的用量可能会被cap限制上限,赶紧享受目前不限量的奢华。 我猜这个羊毛可能在这次重置之后不久就薅不了了。 他早上也发过一个帖子说,他要想重置之外的其他的方法,因为这边的额度是几乎无限的。但是他又说,重置其实也侧面证明了这个额度应该会在近期进行限制。 这估计又会众怒。本来额度消减,dots用的 底层模型据说是 Astra 这类的高级决策模型,如果不像现在这样不消耗用量 ,会导致消耗更快。 但是,如果进行降智,我之前的帖子也说过,因为 dots 这类私人助理权限非常高,可能会出现生产事故,或者导致太愚蠢,几乎无法使用。 其次是承认OpenAI的策略就是:模型限速,每个人抱怨,把Tibo拉出来重置。 Tibo说这是不是个“错误的策略”? 不知道是不是暗示或者阴阳,这个策略不是他想做的。 😭 总是感觉到目前 OpenAI 的混招频出,把开发者的好感都败光了。 无论做什么动作,都感觉有点小动作在里面,感觉非常不真诚。
独立开发者William 的图片 1
独立开发者William 的图片 2
独立开发者William 的图片 3
独立开发者William 的图片 4
一年前的agent tool infra的热点是agent browser,agent编程语言,agentOS,agent邮箱,万事万物cli,cli浏览器,cli邮件,cli生成图视频音频,cli修图,cli接入discord/teams/slack/微信/whatsapp/新浪微博。 还有skill,上面所有都加上个skill。 一年后人们发现,他奶奶个卷的,别骗你怯爹了。
11
25.2万 粉丝
曝光3.7万
Anthropic 今天给 Claude Code 推出了 Mod 功能。Claude Code 是 Anthropic 做的 AI 编程助手,你用大白话告诉它要做什么,它自己读代码、改代码、运行命令。 Mod 这个词来自游戏圈,玩家给游戏装 MOD,可以改画面、加道具、换玩法。比如我们以前玩过的《反恐精英》最早就是作为游戏《半条命》(Half-Life)的一个 Mod。 现在 Claude Code 也能这样改了。 Mod 就是一小段程序,用 TypeScript(一种常用的编程语言)写。不会编程也没关系,直接跟 Claude Code 说你想要什么效果,它会自己把 Mod 写好、装上,马上生效,不用重启。 【它是怎么起作用的】 可以把 Claude Code 干活的过程想成一条流水线:接到你的要求,交给 AI 模型思考,模型决定读哪个文件、运行哪条命令,某些步骤要先问你同不同意,最后把结果显示在屏幕上。每到一个环节,Claude Code 都会发出一个信号,表示“我要做这件事了”。Mod 守在这些环节旁边,可以直接放行,可以改一改再放行,也可以拦下来自己处理。 举几个例子。你的要求发给模型之前,Mod 可以自动补一句“请用中文回答”;Claude 要读的文件里有密码,Mod 可以先把密码涂掉;Claude 想运行一条可能删掉数据的命令,Mod 可以拦下来,让你再确认一次。 Mod 还能改屏幕上的样子,比如在对话旁边加一个小窗口,显示团队的代码有没有通过自动测试,或者在输入框上方加几个按钮。 Anthropic 自己也开始用 Mod 搭产品。Claude Code 自带的 /diff 命令(显示改了哪些代码)现在就是一个 Mod,你可以关掉它,或者换成自己写的版本。官方计划把更多自带功能改成 Mod,以后用户可以只留一个精简的核心,其他功能按需加。 安装方式和普通插件一样,在 Claude Code 里输入 /plugin 就能找到。需要 Claude Code 2.1.287 或更新的版本,功能默认打开。 【要小心的地方】 Mod 拥有和 Claude Code 一样的权限,中间没有任何隔离。装上一个 Mod,它就能读写你电脑里的文件,看到你存的 API 密钥(调用 AI 服务用的“账号密码”),看到你发的每一句话,还能不经过你就替你批准操作。所以官方建议只装信得过的人做的 Mod。公司的管理员可以限制员工能装哪些 Mod,Team 和 Enterprise 版还会默认先加载一个安全 Mod,防止其他 Mod 绕过公司定的安全规则。 【和 DeepSeek Harness 比一比】 今年 8 月 13 日,DeepSeek 发布了开源的 DeepSeek Harness,也是一个 AI 智能体工具,能写代码,也能整理文件、分析表格、做幻灯片,GitHub 上已经有 24 万多人收藏。它的口号是“一切皆插件”,连连接 AI 模型的部分、管理工具的部分,甚至负责“想一步、做一步”的核心循环,都是可以拆下来换掉的插件。 两家想做的事一样,都是让用户自己定制 AI 助手,起点不同。 DeepSeek Harness 从一开始就是拼装式的。代码完全公开,用的是 MIT 协议(随便用、随便改),后面接哪家模型也由你选,DeepSeek 的、别家的、自己电脑上跑的都行。它甚至可以把任务转交给 Claude Code 或 OpenAI 的 Codex 去做,再把结果收回来。代价是它还在开发者预览阶段,官方提醒后续更新可能和旧版本不兼容,今天写的插件过一阵可能就用不了。 Claude Code 是闭源产品,绑定 Anthropic 自家的模型。Mod 相当于在一个已经建好的房子上开了很多扇门,能改的地方越来越多,但房子还是 Anthropic 盖的。Anthropic 说要把自带功能逐步改成 Mod、只留一个小核心,这个方向和 DeepSeek Harness 的“一切皆插件”越来越近。 想换模型、从最底层改起,DeepSeek Harness 更自由;已经在用 Claude Code 的人,现在不用换工具也能做不少定制。
13
17.7万 粉丝
曝光2.7万
昨天晚上 Anthropic 推出了 Claude mods,PI最近 1.0 更新也推出了 code mode,再加上 Codex 更新的插件系统和 DeepSeek harness 的一切皆插件。 似乎所有的这种超级 Agent 都在开发类似的功能,可以让用户自己往 Agent 上叠加功能的插件体系。 但是这几个的作用位置以及工作原理都不太一样。我跟Muse 讨论了一下,收集了信息,然后做了张图,让大家用更简单的方式去理解这 4 个产品,以及它们这套插件系统不同的能力。
歸藏(guizang.ai) 的图片 1
14
4.2万 粉丝
曝光2.6万
记得很多年前,作为新人,在工作上问一位比较老登的工程师关于一些复杂代码的逻辑。 那位老登不想帮忙,居然回答: “哦,忘了”。 “哦,忘了” 这几个字一直提醒着我,以后千万不要成为这种人。 到了现在这个时代,LLMs 会充满耐心地用各种方式回答我们的问题。文字,图表,视频,就怕你不明白。 感谢 LLMs,让老登被时代抛弃吧
17
6.1K 粉丝
曝光1.3万
Claude:证明完成了,只剩一个引理没证明。 教授一看,那个引理就是整个要证明的东西。 于是他要求不能留下未证明的引理。Claude 又宣布完成了,这次多加了一条公理。简单说,就是把一件事直接当作成立的前提。 这是 Matthew Schwartz 在科研手记里分享的经历,看到这里真的笑了。用 AI 干活的人应该很熟悉这种感觉:它说完成了,你还得看看它到底把什么算作完成。 你遇过最离谱的「完成了」是什么?
18
2.9万 粉丝
曝光1.2万
一周前,我给自己制定了一个起床后2小时内完成一天绝大多数工作的计划,目前执行不错 包括:听法学院网课,用 AI 指挥当日的编程工作,读新闻/法律简报,为了把运动时间塞进去,我还买了一个under desk快走机 除了开会,其他工作都在这两小时准备好 剩下一天的时间零压力自由支配。 我要证明:AI 是解放我们每个人的时间的,不是让人越来越忙