复杂任务 AI 动不动执行要 1~2 个小时,人不可能一直坐在电脑旁等结果,有没比较好的方案能让 AI 实现 24 小时自动化开发,并且可以设定哪个 AI 负责验收和补充,哪个 AI 负责开发。以及 5 个小时额度耗尽,会自动等 5 小时额度恢复继续执行任务?
复杂任务 AI 动不动执行要 1~2 个小时,人不可能一直坐在电脑旁等结果,有没比较好的方案能让 AI 实现 24 小时自动化开发,并且可以设定哪个 AI 负责验收和补充,哪个 AI 负责开发。以及 5 个小时额度耗尽,会自动等 5 小时额度恢复继续执行任务?
1
kyro00000 1 day ago
雇 2 个人?
|
2
kyro00000 1 day ago
两班倒?? 据我所知,有些工厂的老板就这么干。
|
3
ldy619354397 OP @kyro00000 为啥明明能用软件实现的需求还要人工?
|
4
kyro00000 1 day ago
人工能挨骂,AI 挨骂直接罢工。
|
5
crysislinux 1 day ago via Android
用人工就说明这个事情软件还做不到
|
6
ldy619354397 OP @kyro00000 不,你骂 AI ,AI 会给你道歉,倒是没有 token 了,AI 是不会鸟你,且不能拖欠 AI 的 token
|
7
ldy619354397 OP @crysislinux 理论上这个应该是不难,甚至我也想过写一套自动化规范让 AI 执行,不过我更倾向于 V 友们能分享下比较成熟的自动化方案
|
8
zls3201 1 day ago
让一个 subagent 干活,另一个 subagent 监督与调度
|
9
ldy619354397 OP @zls3201 subagent 要用什么工具或软件实现呢?
|
10
zls3201 1 day ago 你问 ai agent 啊,问我干嘛 去问 claude
|
11
orion1 1 day ago
不需要你指明方向吗,不需要审核,下一个命令的编写?
24 小时全让 ai 自己搞基本上离最初的要求离很远了 |
12
jacketma 1 day ago
这个你完全可以自己按需编排 Agents 工作的,一个工作完了就通知另外一个 Agent 起床来验收,完全可以实现 24 小时无人值守。最终能不能真的实现需求,那要看运气了
|
14
Dragonish3600 1 day ago via iPhone
方案很多啊,关键是你要搞清楚需求是什么
是你扔一个 feature 让 AI 自动开发 还是让 AI 监控 issue/message 自动响应,自动修 bug 还是让 AI 根据 XX 自动做 YY |
15
ldy619354397 OP @orion1 肯定是安排好任务计划,让 AI 按顺序执行
|
16
ldy619354397 OP @Dragonish3600 让 AI 根据 XX 自动做 YY
|
17
oliveira 23h 18m ago Loop Engineering
|
18
lifei6671 22h 56m ago
你需要的真就是 loop Engineering ,cursor 的 projects 就是个干这个的,一个 Agent 负责项目管理的角色,指挥其他 Agent 干活,指导验收完成,不过你还要去 5 小时额度恢复再继续,就得自己实现了。
|
19
qwasfun 22h 55m ago
|
20
zisen 22h 42m ago
人白天和 ai 讨论 spec ,晚上让 ai 编码实现,测试,验收,第二天人上班再验收,循环往复
|
21
SanjinGG 22h 40m ago
@ldy619354397 #3 能用软件解决就不用问了吧?直接让 ai 出方案做软件就行了吧
|
22
lllllllccccccc 22h 15m ago
我目前结合公司项目正在实现的方案,还在逐步实验:
1 ,项目需求文档,各个功能目标 2 ,各个功能内加日志记录异常,有界标记,上传到服务器或者指定位置 3 ,定时任务/定时脚本(暂时还没加,也想着对接到微信飞书之类的)定期定时分析日志 4 ,把日志发现的问题分析出来,结合 1 分析是否达到目标,没有达到结合标记判断为什么,发生了什么,给出优化计划 5 ,结合 4 的优化计划结合当前带么和 1 需求反问 2 遍,再生成优化计划以及新日志标记 6 ,执行优化计划,打包上传,持续执行 |
23
ldy619354397 OP @zisen 那么 spec 要怎么要怎么让 AI 按顺序执行呢?
|
24
ldy619354397 OP @lllllllccccccc 你这是自动优化方案,而不是自动开发方案吧?
|
25
ldy619354397 OP @SanjinGG 有成熟的软件肯定比自己开发更好
|
26
lllllllccccccc 22h 11m ago
@ldy619354397 我想的就是多打标记,最终做出来的东西还是要复查的,自动开发方案我认为最终还是围绕需求文档作为目标来的,做出来后反复测试验证,优化修复,再测试验证
|
27
zisen 22h 5m ago
@ldy619354397 #23 spec 里面也包含了任务安排,可以用 matt 的 skills 集合,不过后面还是建议搭建自己的工作流
|
28
yangzhezjgs 21h 52m ago via Android 没有人工审核,很容易越跑越偏,产出没有意义的东西
|
29
abc0123xyz 21h 42m ago
@yangzhezjgs #28 +1 前几周搞个新功能,全程不管,烧了几十亿,造了坨大便
|
31
haha1903 21h 4m ago
@ldy619354397 @oliveira #17 说的是对的,估计这就是你要的。
|
32
strobber16 20h 42m ago via Android
得加钱
|
33
Building 20h 35m ago
20 美金就别拼命了,还 24 小时自动化,最后一坨大的根本看不过来,除了浪费 token 价值约为 0
|
34
liang7878 20h 21m ago
根据我一天烧大几千美刀 token 的经验,这种自动化最后会生产一大堆屎山代码,出来的功能大概率还需要做很多精细的打磨
|
35
ylual 20h 13m ago via iPhone
Claude code 的 subagent 就是这样,高级 agent 写 spec 和 plan ,累活脏活就会派给 subagent 去干,review 又会用高级 agent 来 review
|
36
nsjs 20h 6m ago via iPhone
关键在于需求如何对齐。真人做开发任务,都需要在过程中反复对齐需求,agent 只负责开发,需求对齐最终还是要传导到你这里的,不是加一个 agent 负责验收就能解决的事。你可以让 agent 一次性做得很多,做错了会增加成本,浪费很多 token 和时间。
Agent 和现实世界的交互就是命令行和对话框,最多看看静态资料,非常缺少隐式需求探索的能力。而且目前长期记忆仍然是一个问题。 这些都加剧了这个问题。 |
37
xiaoheicat 19h 21m ago
Loop 的结果如果跟需求偏差太远有什么意义呢,人的介入不就是要多注入一些个人的品味跟审美吗
|
38
axon 19h 0m ago
/goal
|
39
uasier 18h 52m ago
自荐一下我写的一个工具,基于 herdr 可以实现任务连续运行,支持 pi/codex/claude/grok
|
40
uasier 18h 52m ago
|
41
gumayusi 18h 0m ago
我发现,“让 AI 用户使用 AI 时产生的问题能通过 AI 自行解决的占比”是一个更好的 AGI Benchmark 。
|
42
bkmi 17h 35m ago via Android
这不是很多方案嘛,OpenAI 就出过一个 demo:
https://openai.com/index/open-source-codex-orchestration-symphony/ https://github.com/openai/symphony 我试着跑过,就是巨耗 token |
43
AEDaydreamer 17h 29m ago
你需要 to-tickets 加上 cursor 或者 grok bot 的 cloud agent ,可以满足 24h.
|
44
helianling 16h 9m ago
多个模型搞个 subagent 呗
|
45
doraemonki 15h 54m ago
没那么复杂,主控开 sub-agent 一个提示词搞定。codex 或者 claude 都行,tokne 要够多。
https://github.com/doraemonkeys/ai_prompt/blob/main/general_orchestrator.md |
46
thomas0356 15h 26m ago
让它直接快进到自动赚钱多好,你躺床上刷抖音 美滋滋
|
47
smallest10 14h 40m ago
spec+任务/看板清单+工作流+subagent 不就好了吗。
白天就跟 ai 讨论需求,让它自己生成 spec 和任务/看板清单,晚上睡觉的时候让 ai 把任务/看板清单上的全做完。 不过 5 小时循环额度这个估计得自己写插件来实现了,最好在额度耗尽前先让 ai 保存进度然后停工。5 小时后让插件恢复上述流程。 |
48
xue777hua 13h 8m ago via iPhone
|
49
aitobox 10h 37m ago
这是可以的,但是全自动我还没有做到,现在还是半自动;
1. 写一个 skill A 拆解任务提 github issue 2. 写一个 skill B 可以自动拉取 github 上优先级最高的 issue ,然后调用 skill C 3. skill C 调用 brainstorming, writing-plan, exec-plan 完成 issue ,然后调用 skill D 4. skill D 调用 grill-me ,全部自动按照推荐确认,完成代码 review 和修改 5. 有个 skill 在后台自动检查 skill D 的完成状态,自动提交 pr 6. 人工检查 pr 并合并 .agent.MD 要写一条规则,让 skill 尽量自动处理: `如果你有 90 %以上的把握,请显式说明并自行决定,没有十足把握才要求我决定。` 这样每天的工作,就是有右键通知的时候,去看看 pr 靠不靠谱,rebase and merge; 当然,单元测试,合并规则等等流程要在 github 上建好; |
50
acthtml 8h 3m ago
symphony
|
51
TomatoCLI 7h 57m ago
> 5 个小时额度耗尽,会自动等 5 小时额度恢复继续执行任务。。。
你买个便宜的不管啥模型按量计费的轮询,或者自己做个脚本轮询,恢复额度就让会话继续不就行了。。。 |
52
NoobNoob030 7h 40m ago
只想实现 24 小时 loop 方案很多,如何把控运行质量、如何节省上下文提高效率才是关键
我个人实践是不太喜欢长会话的,在 high 或 xhigh 的模式下,AI 会有种为了多而多,输出很多边界情况的思考,有时确实会让需求更完善,但也有上下文过多的负面影响,如果再加上 subagent 并且需求和文档都很随意,那项目跑几天就会变成一大坨屎山 我更倾向于“”单任务单会话基于文档沟通“,多频次小功能去迭代功能,再配上清晰简洁的文档规范去把控整体项目进度 |
53
cloverzrg2 6h 50m ago
为什么你的需求可以让 AI 跑一天都不用 review 产出的?
|
54
fish2050 6h 43m ago
7*24 小时做出来的东西一眼不看,能用么……
|
55
izzzz 6h 29m ago
/goal 模式,结合一个检测脚本,不是很简单实现 24 小时吗?之前 codex 我用 goal 模型自己都能跑一天多,就看你有没有 token
|
56
uxstone 5h 57m ago
很好奇有那么多业务需求是要 7*24 不停的开发吗?开发出来有用户去使用吗?
|
57
AppxLite 5h 20m ago
让 hermes 去监督,前提是你 token 足够啊
|
58
manwhatcanisay 5h 19m ago
公司的话 cognition 的 devin ?
个人就随便折腾折腾 |
59
LuoDiNate 5h 19m ago
|
60
ldy619354397 OP @uxstone 我目前的业务就是开发公司智能体,目前是 AI 执行太慢了,一个任务要执行 1~2 个小时
|
61
ldy619354397 OP @yangzhezjgs 所以我也在创建一套 AI 开发规范,上班时间尽可能跟 AI 多沟通,让 AI 写好方案再人工审核,尽可能避免跑偏
|
62
ldy619354397 OP @Building 目前在用 Claude MAX 5×套餐,是有 5 小时限额的,这个避免不了,另外预算不是问题,而是能不能实现,且不跑偏
|
63
ldy619354397 OP @NoobNoob030 我会提前和 AI 沟通,给每个任务写好提示词,AI 执行完一个任务后,确认没问题后,就执行下一个任务的提示词
|