你们的Sol喜欢做全量测试么

Draw 2026-08-09 00:33 1

有点蚌埠住

我就要求改了两三个小UI,它跑了1小时

做了近550个测试

让他搜个txt文件都恨不得把整个项目的文件全读一遍……

你们的Sol有这情况么


二编:

说来我还发现了个很奇怪的特征(未经测试,可能只是我的错觉)

我提5个要求,和提20个要求,如果复杂度类似,跑的时间,其实很接近……

是不是它把所有的功能全短时间内完成了,大头全花在测试上……这样测试一个功能是那个时间,测试N个功能也是那个时间

最新回复 (16)
  • 󠅕󠅣 08-09 00:34
    1

    操了 我也是 我用的thinking max 给我跑了十几个小时 10Btoken我服了 ^-^

  • 董炸淘 08-09 00:34
    2

    从头写项目可以这样。小改动要提示词约束一下,也还算听话。


    sol就这样,过于主动

  • apparition 08-09 00:35
    3

    我坐好了

    谁来替我解释一下 Sol 的伟大事迹

  • 观人 08-09 00:36
    4

    喜欢 我项目还小 跑一次测试5分钟,但是动不动就跑 动不动就跑…我都想骂人了,

  • WWT 08-09 00:37
    5

    包喜欢的呀

    但我觉得最神的还是luna max

    反复测试审核 然后上下文压缩 然后又反复几次就目标偏移 完成一次任务要四五个小时^-^

  • cut 08-09 00:37
    6

    太恶心了 又慢又浪费额度,佬们有没有简单有效的焚决

  • Draw 楼主 08-09 00:38
    7

    原来大家都是难民,我心里平衡了 ^-^

  • 星渊清梦 08-09 00:39
    8

    确实过度测试了,但是不好写提示词平衡

  • Air84 08-09 00:40
    9

    不管干点什么都要测一下,加点debug输出都要冒个烟^-^



    你用我token测你(代)码,你每个push都测你(代)码


  • 小猫曦月 08-09 00:41
    10

    现在是在AGENTS.md里面写的第一条约束就是不得过度测试,不得过度构建 ^-^

  • ShrimpInTheSea 08-09 00:43
    11

    没找到好办法,目前就是在agent.md里约束,大意如下。目前用着还行,正在研究减少过度设计的提示词。


    非必要不测试,优先读取之前的测试结果。

    小改动只做定向验证,不增加测试。

    优先执行最小测试,证据不足或影响范围扩大才升级。


    编辑,最好配合关掉各种流程skill,我这儿从几百个降到几十个了

  • hualaka 08-09 00:45
    12



    非常喜欢,我说了好多遍不要做全量测试,刚刚还在说来着。(虽然我是 deepseek, 但是 gpt 也是这个样子。)

  • moebo 08-09 00:46
    13

    我在用的限制提示词,分享给大家。


    执行效率约束


    不要过度思考,不要过度防御式编程,不要反复 review,不要过度设计,也不要把大量时间浪费在推演假设风险上。

  • 小叮当 08-09 00:52
    14

    主要看是用哪个AI,国产的给太多任务会搞砸,头部的话给多个能完成较好

  • ShrimpInTheSea 08-09 00:55
    15

    gpt狗屎的地方是,你不指出来几次,他有时候会自己找出各种奇怪的理由说这么设计没有过度,是必要的。

  • jay 08-09 01:05
    16

    我让它把项目代码整理下传 GitHub 它也跑个全量测试先 跟有病一样 我直接开喷 有没有 bug 不影响我传 GitHub 吧,你测尼玛呢测

* 帖子来源Linux.do
返回