群发资讯网

用codex写过5个完整的agent,看了这篇文章才知道自己还不太懂codex。 虽然是万字教程,但只讲了一件事,其实真正决定能不能用好codex的,不是会耍多少厉害的skill、cli、插件,写了多长的prompt,而是做好3件大事: 控制权限、及时纠偏、测试验证。 为什么说是大事呢?因为codex的执行原理是Prompt ​

用codex写过5个完整的agent,看了这篇文章才知道自己还不太懂codex。

虽然是万字教程,但只讲了一件事,其实真正决定能不能用好codex的,不是会耍多少厉害的skill、cli、插件,写了多长的prompt,而是做好3件大事:

控制权限、及时纠偏、测试验证。

为什么说是大事呢?因为codex的执行原理是Prompt → Plan → Execute → Verify,一句话就是codex会按你给的提示和上下文来计划和干活。

所以你得管理好权限和边界设置文件的最小操作目录,不然codex读取了无用的材料、数据,安装了不必要的依赖和技能,做出的东西不伦不类。

权限管理的原则是,边界越小越好,权限只给必要的。

及时纠偏是为了不浪费token和时间,因为它一旦开始错误的coding,结果也会是错误的,你需要在它跑偏后及时拉回来,比如文章里提到的纠偏建议:

“接到任务先判断真正的问题和最短可靠路径。能直接完成,就不额外搭流程;能复用现有成果,就不从头重做;能修改局部,就不推倒重来;能一条命令解决,就不写脚本;能一个脚本解决,就不建项目。”

这个是很实用的优化策略,ai不是神,没法一次性开发出微信这样的应用,需要你经常打断来优化它的策略。

为什么测试验证才是vibe coding最耗费时间的活儿,有人误把codex说的“完成了”当成真的完美搞定了,但有可能它编造了数据、虚构了流程、只交付了测试界面,完全没法用。相信很多人也在豆包、龙虾等agent上有过类似的体验。

所以真正的完成了是指你反复测试、确认codex没有虚构事实,没有越界,没有把demo当交付。

做到这三点不容易,需要很熟悉codex的功能用法,作者在文章里详细介绍了怎么打开正确目录、建立任务、控制权限、查看改动,什么时候该用 Plan、Skill、Plugin、MCP、Automation、goal等,可以好好看看。大模型codexhow i aichatgpt ai