现在用 Coding Agent,最累的部分是你得一直盯着它
Agent 确实写了很多代码,但整个任务能不能继续往前走,往往还是取决于你有没有坐在电脑前。
Romain Huet 这次演示的新 Codex,开始处理这些代码之外的工作。
一个任务可以拆给多个 subagents,有的负责 Debug,有的做前端,有的补文档。
Codex 可以自己打开浏览器检查结果,操作 iPhone Simulator,根据截图和视觉批注继续修改。
任务做到一半,人离开电脑,也可以在手机上查看进度,或者通过 SSH 连接远程 devbox 接着处理。
代码完成后,它还能继续创建 PR、检查 CI、处理 review comments,最后把是否合并的决定交还给开发者。
看完整段演示,我的理解是:
Coding Agent 过去主要帮我们减少写代码的时间。
新 Codex 想进一步减少的,是等待、切换工具、重复检查,以及不停催着 Agent 继续下一步的时间。
这对经常使用 Codex、Claude Code 或 Cursor 的人来说,应该很熟悉。
我们想要的是,在目标和边界明确之后,它能把一个开发任务持续推进到可以检查、可以交付的状态。
开发者依然需要做判断,哪些需求值得做,结果是否正确,风险能不能接受,代码最终要不要合并,这些责任不会消失。
只是以后,我们可能不需要再全程守在 Agent 旁边,手动推动每一步了。
如果这套工作流真的稳定下来,一个人能够同时推进的事情,会比现在多很多!
显示更多