@
weixind 那这要是一个点没想到。。。岂不是 后面推翻重来?甚至有时候 只是一个 boolean flag 整个架构没写。。都要换一轮。。。比如 tombstone 这种东西。。反正诸如此类的吧
但是我感觉你似乎很多架构的 md 文档都是靠 AI 生成的, 真的一字一句看过来啊???
即便是 审阅过了, 万一代码里面 有些没有执行到位, 怎么办呢?
--
我之前试过 goal 不是很满意,几个原因:
- 生成的 md 文件 头皮发麻, 不想看, 特别是 codex , 文绉绉的 `落地` `对齐` 新八股看得人简直累死
- 生成的 文件好不容易看完了,执行不到位 (任务过大, 多次 compact )
- codex 就是给你拼命复杂化,复杂到 可能他自己都被绕进去了
- 但关键的地方, 他又考虑不到,不是主要需要的架构的地方,他又瞎 jb 考虑。。。 搞的我审阅疲劳 (特别是对着八股文更加如此) 最终 导致我自己的思路甚至都 miss 了一些东西
为啥我知道代码不满意呢? 因为我亲自 review 代码了!(几万行! 我硬着头皮 review 的! )
于是改了一轮又一轮 一轮又一轮, 折磨了我 3 个星期,最终实在受不了了,最后我自己花 1 个星期,回到了古法编程(自己的 mindmap + AI 问答式 + 少量 goal) 一个星期完成了所有的任务。
之前每天 0.5-2b token ( gpt-5.4 xhigh fast goal sub-agent) 除了 生成一堆令我困扰的垃圾以外,啥价值也没有沉淀下来。
所以我对于中大型项目 (我看你的项目不算小, 和我的 package 数量差不多) 感觉 goal 可能不一定靠谱
我之前还试过 ralph loop 类的方案, 也不是很满意。。。
目前为止,long running task 没有找到什么满意的方案,我自己的答案倾向于:这是无解的。因为 写好了所有的测试和验证 约等于 写好了所有的代码。
说到底, 写代码本身就是在给 General Purpose 的 Program Language 加上 type check + while loop
如果我把 type check 都写给了 LLM , 那几乎就等于自己把代码写出来了。。。
--
当然, 我也用 goal 写过自用的小工具, 但基本都是当黑盒来用, 跑完一轮 goal ,就直接用,也就是不 reveiw 代码。那自然没有这种痛苦了。
我其实大致看过代码,头皮麻了一下就闭着眼睛用了。。。 我的 goal 里面有一个步骤是:让他发送一个简单的 http 请求,codex 居然给我用 node:http / node:https 两个核心用 if/else 分别去发送请求的。。。
好久都没有见过 这种用 node:http / node:https 的写法 而不是用 fetch() 执行网络请求了。。。