评论中还有 openclaw 自己使用的 test audit 这个 skills:
大家可以看看,它的任务是告诉 agent 什么测试应该加,什么测试是垃圾不应该加。
在开始写测试的时候,agent 先回答四个问题是否必要加测试的问题,判断通过了才加。
显示更多
和前几天的观点一样:OpenClaw 删掉了大约 40 万行自己的测试代码
代码覆盖率几乎没掉 原因是现在的模型特别爱写没用的单元测试了,为了测试而测试,写十个case 去判断常量里的字符串。
作者还说:假如只跟 agent 说 清理一下,它会很早就停了不改了 ,要给它一个更狠的目标,比如 删掉最没用的 20% 测试 同时覆盖率波动控制在 2% 以内
显示更多