朱亚威
07-12 · 得物App
Codex
Claude Code
写了一篇长文,讲 Loop Engineering,起点是我自己被坑的两次"假绿"。我把"Codex 实现 → Claude Code review → Codex 复核"做成过自动化流程。有一次改的是 iOS 代码,验证器跑的却是 Python 测试——全绿通过,但被改的代码根本没编译过。更危险的是,Agent 靠删掉原有行为消掉了报错,review 模型因为没拿到 PRD,也觉得没问题。这件事给我的判断是:系统会收敛到验证器接受的状态,不一定是真实正确的状态。 红色错误会逼人介入,绿色错误会让整个系统以为自己已经完成。文章后半部分用一个我真实跑通的闭环(iCloud 素材 → 自动生成小红书草稿 → Computer Use 上传 → 停在发布键前等我点击)讨论一个更大的问题:研发的反馈大多在机器内部(编译、测试、运行),产品工作的关键反馈在系统之外(用户、业务方、组织取舍)。所以产品场景的 loop,核心不是让 AI 自主跑得更久,而是设计人在哪里回来。好的 loop 不是永远不需要人的系统,而是只在真正需要判断时,才把人叫回来的系统。全文:
https://taou.cn/a/inSbk0
发布于 上海
分享
1
2
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn