好像没有一个大家都认可、称得上众望所归的方向。评论区给了不少思路,我自己试了几个,但还是有几个点有点纠结。
有佬说让 agent 自己加单元测试就行。但我有个疑惑,就是 agent 自己写的测试,会不会跟它写的代码一起错?相当于裁判下场自己判,全绿也不代表真对,而且有些方向它自己可能压根想不到。这怎么保证测试本身是对的?
或者把所有功能、历史踩过的坑都落盘成测试,听着最靠谱,但对日常随手搓的小工具来说,维护成本会不会有点高?
还有佬说该花的小钱避免不掉。所以我也去试了之前问过的那个测试 agent 工具,目前还在用免费额度,还算够用,而且确实省了不少时间和搭测试系统的脑细胞。就是不知道之后量大起来还够不够。
我非测试出身,想把这些也一并兼顾,感觉还是有点吃力。目前我倾向于干脆多挂一个 agent 专门帮我 monitor 和跑测试。
佬们怎么看?
有佬说让 agent 自己加单元测试就行。但我有个疑惑,就是 agent 自己写的测试,会不会跟它写的代码一起错?相当于裁判下场自己判,全绿也不代表真对,而且有些方向它自己可能压根想不到。这怎么保证测试本身是对的?
或者把所有功能、历史踩过的坑都落盘成测试,听着最靠谱,但对日常随手搓的小工具来说,维护成本会不会有点高?
还有佬说该花的小钱避免不掉。所以我也去试了之前问过的那个测试 agent 工具,目前还在用免费额度,还算够用,而且确实省了不少时间和搭测试系统的脑细胞。就是不知道之后量大起来还够不够。
我非测试出身,想把这些也一并兼顾,感觉还是有点吃力。目前我倾向于干脆多挂一个 agent 专门帮我 monitor 和跑测试。
佬们怎么看?