skill优化验证小技巧,实测还行

加冰 2026-06-25 17:06 1

最近让codex优化skill但是又不好验证skill的效果,有时候还越整越乱,越不稳定。


想稳定主要是为了在便宜的模型上也可以跑,于是cc里配的minimax,也引用同一个skill,让codex边优化边使用claude -p 的方式在minimax上去验证。


这么跑优化的质量稍微好一些了,codex确实可以根据反馈再调整。



和这个梯子说的也不谋而合了,感觉现在校验和迭代做好的话生产力嘎嘎猛。

最新回复 (11)
  • Rejector 06-25 17:09
    1楼

    我都是把AI当人的,它自己写skills,自己测skills,反正都是它自己用那必须是它自己做才是最好的。

  • 让我再睡一会儿 06-25 17:12
    2楼

    我也想让ai自己写一些skills然后自我验证并优化,但是没有可以验证的方式,只能靠我自己去做验证然后告诉它哪里不对

  • Yang 06-25 17:14
    3楼

    说实话 没看懂。 ai督促ai的意思吗?

  • VincentChen 06-25 17:49
    4楼

    写的skill,新对话用AI自己跑,跑了之后让他自己总结跑的时候哪里有问题,自己修改,这样反复迭代

  • flyli 06-25 18:25
    5楼

    是我太菜了吗, 看的不是特别懂呢

  • Demorain 06-25 18:44
    6楼

    我还以为是想要试试便宜模型跑loop优化skill?只用minimax验证的话能便宜多少呢,我看别人好像是强模型做计划和review,弱模型比如minimax就可以跑execute执行计划,佬是这样做吗?

  • 加冰 楼主 06-25 20:31
    7楼

    嗯嗯,是嘞。就是skill有时候达不到要求,就需要优化,但是优化的时候会遇到一些瓶颈,不太好优化。

  • 加冰 楼主 06-26 01:14
    8楼

    嗯嗯,我一开始也是人工重复验证,太累了

  • 加冰 楼主 06-26 01:16
    9楼

    实际就是让agent自己造一个空的上下文,相同的输入,只变skill,看输出效果是不是实际达到优化了,没有的话就继续调整,然后再验证这样一种循环。

  • 加冰 楼主 06-26 01:19
    10楼

    就是想个办法保持输入和上下文一致,让agent自己调整skill,自己执行看输出,不行就自己再调整

  • 加冰 楼主 06-26 01:21
    11楼

    我希望skill在minimax里也能用,因为便宜,我不想skill搞完之后只能用gpt驱动,所以用minimax验证。但是gpt能力强一些,调整skill的效率高,所以让gpt优化skill。

* 帖子来源Linux.do
返回