用/goal让50个agent24小时上班的tricks
上班日记2:分享几个使用/goal上班的tricks,分四层境界:写goal - 写goal的guide - 让agent自己写guide - 让agent给别的agent写guide
1. 写好 /goal
我自己试下来防止 agent hack 最简单的办法就是把目标定义得足够难和足够泛化。比如只让 agent 优化一个数据集上的某个 metric,它很容易找到一些复杂但只在这个 task 上 work 的 trivial design;但如果直接要求它在 10 个数据集、3 个 metrics 上优化,并且 90% 的 case 都有提升,那实现这个 goal 本身就要求设计有一定泛化性。个人经验是不用太考虑这个目标到底做不做得到,越难越好,跑起来也不用频繁 check,放几天之后结果经常会有惊喜。
2. 写好 /goal 的 prompt
如果任务比较难定义成一个好的泛化目标,用这个格式写可以稍微防止hack/拆家:
“/goal 达成 ,并通过 确认结果有效,同时保持 不被破坏。只能使用 达成目标。在每一轮迭代之间,根据 选择下一步。 ”
3. 让 Agent 给自己写 /goal
如果需求本身也还比较模糊:
“根据 ,帮我设置一个完整的目标,然后使用 /goal 模式执行 ”
Agent会自己启动/goal,也可以把2的模板给它参考用来给自己写prompt。
4. 让 Agent 给其他 Agent(s) 写 /goal
(高年级PhD带intern)
例如你有 10 条互相独立但每条都需要跑很久的串行实验,不用自己开 10 个 screen/tmux 再一个个开codex。可以直接开一个 Manager Agent,告诉它自己的职责是 Manager,需要完成这 10 条实验,让它新建 10 个不同的 screen 里面分别dispatch 10 个 Agent 设置 /goal 并执行,每个 Agent 独立负责一条实验。这样就只需要跟Manager对话就行了,时不时让它总结一下进度,把已有的结果画个图什么的。
howto入门codex 狗生是旷野 agent

