做了一个ai工具,需要测试,有兴趣吗?

明之 2026-09-17 19:27 1

嗨咯,各位佬友大家好啊,我们开发了一款ai工具,希望有些人能够参与测试,我们会提供一定量模型的token供大家使用与测试,目的是希望大家能够积极反馈使用中遇到的问题。


接下来我展示一下工具的具体截图。


其实大家应该对此会非常的熟悉




测试方向:


1、识别问题的精准程度

主要了解此工具对于ai模型的工具有如何的提升,是依靠模型本身的智能还是有所提升。


2、工具的性能

主要了解此工具在电脑上的运行性能,是否卡顿。


3、是否更流畅与方便。

主要了解此工具对于大家使用时,是否用起来流畅,舒心,否帮助到自己更高效的完成任务。

最新回复 (11)
  • 茴香豆 09-17 19:29
    1

    你这个是定制的工作流还是什么吗,如果只是纯agent的话,每个模型都有专门适配它家的agent,感觉用他们自带的可能效果会比第三方的好?

  • qianye223 09-17 19:30
    2

    工具性能的话,感觉整个插件实时监控占用会好点

  • 明之 楼主 09-17 19:32
    3

    目前是测试基本功能,制定化的工作流的暂时不测试。对此您说的“每个模型都有专门适配它家的agent tools”的效果比第三方好,在适配性上,这可能会,但对具体问题上可能需要考量。

  • 明之 楼主 09-17 19:35
    4

    这个可以考虑有,不过我们也初步全面压测过了,目前表现较好。

  • 茴香豆 09-17 19:50
    5

    其实是这样的,因为现在各家都有他们的agent,我个人感觉每家功能都是差不多的,然后就你目前的这个来看貌似和其他家的话没有什么特别突出的不同,你需要往差异化上面发展而不是同质化,因为我现在看到的是同质化比较严重,该有的功能其他的都用,比如我只用ds,那么dsh可能就会对模型有正提升,这是源自于它自己内置的一些提示词和规则会更好。我个人来讲,你要拼对模型的提升感觉这条路走不通,因为他们官方自己做肯定不会比外面第三方的差呀,他们自己研发的模型只有他们自己才是最了解的。所以你要么是走几个方向,第一,基于他们的底座进行二次开发拓展,第二,走差异化更多的特性路线。

  • 明之 楼主 09-17 19:52
    6

    我们走的确实不是同质化方向,只是需要满足基本需求。

  • 林黛玉倒拔垂杨柳 09-17 20:01
    7

    上一个搞这个的 y佬 只开了不到一周的金闪闪就道心破碎了,因为没有买家。

  • 茴香豆 09-17 20:03
    8

    主要是这玩意天生就是只能免费没办法做收费的,开源的牛逼的第三方都一大把,更别谈各家官方做的免费的了,dsh还直接开源了,直接对这些agent工具就是降维打击

  • 明之 楼主 09-17 20:03
    9

    不急于一时,做好自己就行

  • 明之 楼主 09-17 20:04
    10

    是的,此工具本身也是免费的,从截图可以看到,它能够自定义配置,并保存本机上

  • Zene 09-17 20:07
    11

    比起你上面的三个问题,我更感兴趣是:

    你的AI工具相比Codex,ZCode,DSH等等同类的 Agent 有什么他们没有的特点?


    如果只是仿照 Codex 这类 Agent ,那其实很难吸引到用户的,原因:

    1.可靠性不够

    2.对各大厂家的 LLM 适配深度远没有他们自己的好(因为在他们模型在)。

    3.没有差异化的功能

* 帖子来源Linux.do
返回