复杂任务 AI 动不动执行要 1~2 个小时,人不可能一直坐在电脑旁等结果,有没比较好的方案能让 AI 实现 24 小时自动化开发,并且可以设定哪个 AI 负责验收和补充,哪个 AI 负责开发。以及 5 个小时额度耗尽,会自动等 5 小时额度恢复继续执行任务?
复杂任务 AI 动不动执行要 1~2 个小时,人不可能一直坐在电脑旁等结果,有没比较好的方案能让 AI 实现 24 小时自动化开发,并且可以设定哪个 AI 负责验收和补充,哪个 AI 负责开发。以及 5 个小时额度耗尽,会自动等 5 小时额度恢复继续执行任务?
1
kyro00000 6h 11m ago
雇 2 个人?
|
2
kyro00000 6h 10m ago
两班倒?? 据我所知,有些工厂的老板就这么干。
|
3
ldy619354397 OP @kyro00000 为啥明明能用软件实现的需求还要人工?
|
4
kyro00000 6h 6m ago
人工能挨骂,AI 挨骂直接罢工。
|
5
crysislinux 6h 6m ago via Android
用人工就说明这个事情软件还做不到
|
6
ldy619354397 OP @kyro00000 不,你骂 AI ,AI 会给你道歉,倒是没有 token 了,AI 是不会鸟你,且不能拖欠 AI 的 token
|
7
ldy619354397 OP @crysislinux 理论上这个应该是不难,甚至我也想过写一套自动化规范让 AI 执行,不过我更倾向于 V 友们能分享下比较成熟的自动化方案
|
8
zls3201 5h 25m ago
让一个 subagent 干活,另一个 subagent 监督与调度
|
9
ldy619354397 OP @zls3201 subagent 要用什么工具或软件实现呢?
|
10
zls3201 5h 21m ago
你问 ai agent 啊,问我干嘛 去问 claude
|
11
orion1 5h 18m ago
不需要你指明方向吗,不需要审核,下一个命令的编写?
24 小时全让 ai 自己搞基本上离最初的要求离很远了 |
12
jacketma 5h 16m ago
这个你完全可以自己按需编排 Agents 工作的,一个工作完了就通知另外一个 Agent 起床来验收,完全可以实现 24 小时无人值守。最终能不能真的实现需求,那要看运气了
|
14
Dragonish3600 4h 44m ago via iPhone
方案很多啊,关键是你要搞清楚需求是什么
是你扔一个 feature 让 AI 自动开发 还是让 AI 监控 issue/message 自动响应,自动修 bug 还是让 AI 根据 XX 自动做 YY |
15
ldy619354397 OP @orion1 肯定是安排好任务计划,让 AI 按顺序执行
|
16
ldy619354397 OP @Dragonish3600 让 AI 根据 XX 自动做 YY
|
17
oliveira 3h 43m ago Loop Engineering
|
18
lifei6671 3h 21m ago
你需要的真就是 loop Engineering ,cursor 的 projects 就是个干这个的,一个 Agent 负责项目管理的角色,指挥其他 Agent 干活,指导验收完成,不过你还要去 5 小时额度恢复再继续,就得自己实现了。
|
19
qwasfun 3h 20m ago
|
20
zisen 3h 6m ago
人白天和 ai 讨论 spec ,晚上让 ai 编码实现,测试,验收,第二天人上班再验收,循环往复
|
21
SanjinGG 3h 4m ago
@ldy619354397 #3 能用软件解决就不用问了吧?直接让 ai 出方案做软件就行了吧
|
22
lllllllccccccc 2h 40m ago
我目前结合公司项目正在实现的方案,还在逐步实验:
1 ,项目需求文档,各个功能目标 2 ,各个功能内加日志记录异常,有界标记,上传到服务器或者指定位置 3 ,定时任务/定时脚本(暂时还没加,也想着对接到微信飞书之类的)定期定时分析日志 4 ,把日志发现的问题分析出来,结合 1 分析是否达到目标,没有达到结合标记判断为什么,发生了什么,给出优化计划 5 ,结合 4 的优化计划结合当前带么和 1 需求反问 2 遍,再生成优化计划以及新日志标记 6 ,执行优化计划,打包上传,持续执行 |
23
ldy619354397 OP @zisen 那么 spec 要怎么要怎么让 AI 按顺序执行呢?
|
24
ldy619354397 OP @lllllllccccccc 你这是自动优化方案,而不是自动开发方案吧?
|
25
ldy619354397 OP @SanjinGG 有成熟的软件肯定比自己开发更好
|
26
lllllllccccccc 2h 36m ago
@ldy619354397 我想的就是多打标记,最终做出来的东西还是要复查的,自动开发方案我认为最终还是围绕需求文档作为目标来的,做出来后反复测试验证,优化修复,再测试验证
|
27
zisen 2h 30m ago
@ldy619354397 #23 spec 里面也包含了任务安排,可以用 matt 的 skills 集合,不过后面还是建议搭建自己的工作流
|
28
yangzhezjgs 2h 17m ago via Android 没有人工审核,很容易越跑越偏,产出没有意义的东西
|
29
abc0123xyz 2h 7m ago
@yangzhezjgs #28 +1 前几周搞个新功能,全程不管,烧了几十亿,造了坨大便
|
31
haha1903 1h 29m ago
@ldy619354397 @oliveira #17 说的是对的,估计这就是你要的。
|
32
strobber16 1h 7m ago via Android
得加钱
|
33
Building 1h 0m ago
20 美金就别拼命了,还 24 小时自动化,最后一坨大的根本看不过来,除了浪费 token 价值约为 0
|
34
liang7878 46 mins ago
根据我一天烧大几千美刀 token 的经验,这种自动化最后会生产一大堆屎山代码,出来的功能大概率还需要做很多精细的打磨
|
35
ylual 38 mins ago via iPhone
Claude code 的 subagent 就是这样,高级 agent 写 spec 和 plan ,累活脏活就会派给 subagent 去干,review 又会用高级 agent 来 review
|
36
nsjs 31 mins ago via iPhone
关键在于需求如何对齐。真人做开发任务,都需要在过程中反复对齐需求,agent 只负责开发,需求对齐最终还是要传导到你这里的,不是加一个 agent 负责验收就能解决的事。你可以让 agent 一次性做得很多,做错了会增加成本,浪费很多 token 和时间。
Agent 和现实世界的交互就是命令行和对话框,最多看看静态资料,非常缺少隐式需求探索的能力。而且目前长期记忆仍然是一个问题。 这些都加剧了这个问题。 |