我做了个主动式搜索插件

Mr_Remon 2026-08-16 00:31 1

本帖使用社区开源推广,符合推广要求。我申明并遵循社区要求的以下内容:



  • 我的帖子已经打上 开源推广 标签:

  • 我的开源项目完整开源,无未开源部分:

  • 我的开源项目已链接认可 LINUX DO 社区:

  • 我帖子内的项目介绍,AI生成、润色内容部分已截图发出:

  • 以上选择我承诺是永久有效的,接受社区和佬友监督:


以下为项目介绍正文内容,AI生成、润色内容已使用截图方式发出




我做了个网络搜索增强插件在dsh和pi上


我用惯grokbuild以后再转pi和dsh明显感觉搜索能力断崖式下降,所有这两天参考了x新开源的算法和grokbuild的搜索方式来自己写了个插件。(我拆了grokbuild以及观察了grok搜索的日志)


他能做什么:


1、主动式搜索:模型会更加主动的调用搜索而不是一直在那里思考


2、搜索效率提高:专门做了客制化的多agent搜索,让搜索等待减少(实测能从串行160s降低至65s)


3、多引擎路由:让搜索结果更加高质量


4、抓取优化:只抓取信息中关键部分其余丢弃,从而省token(我自己测的是能省大概95%)


他的不足:


1、没有Brave,Tavily,Exa的apikey的话会出现搜索劣化问题,现在的方案是用免费引擎配合原生websearch工具,但质量依旧不理想


2、主动式搜索是依赖于prompt,距离RL训练出的还是有一定的差距




效果图



对比


相比各位大佬的开源项目还是显得非常粗糙,还请大佬们多多指点。


Github仓库:


PI:GitHub - Mr-remon219/pi-search-boost: The plunge for pi to boost his search ability · GitHub


dsh:GitHub - Mr-remon219/dsh-search-boost: The plunge for dsh to boost model’s search ability. · GitHub

最新回复 (9)
  • QXK 08-16 00:33
    1

    |
    通过本地 Grok Build CLI( ~/.grok/auth.json 登录状态)进行 X/Twitter 搜索。返回结构化证据(摘要 + 帖子 + 不确定性);在没有订阅的情况下,45 秒超时后会优雅地降级,且不会阻塞调用。 |

    |----| 佬,我看仓库提到这个,那是不是每日搜索的次数是有限的?grok现在有限制吗啥的

  • Mr_Remon 楼主 08-16 00:42
    2

    x实时搜索的话现在还是有限制的,免费额度很少得有supergrok或者xpremium。我现在就在尝试用tavily以及别的一些绕过这些

    其他的话都是正常的

  • QXK 08-16 00:44
    3

    我记得免费的一天真就几次,完事的话我的x是premium,也用不了几次grok。。。。。。但对推特的搜索内容强度是独一档,感觉其他的都很难超过

  • kk C 08-16 00:45
    4

    厉害了,我去根据这个优化下我本地搜索

  • Mr_Remon 楼主 08-16 00:47
    5

    是这样,不过我下午探索的时候发现tavily部分情况下是可以成功抓到x上的帖子的,我再研究研究,后续版本看看能不能加这一条(当前版本的实时搜索主要还是靠tavily,实时性还是差些)

  • QXK 08-16 00:48
    6

    期待佬后续的工作,已经严肃点击star

  • apparition 08-16 00:51
    7

    我个人觉得跟搜索的目标有关

    exa 偏专业领域

    Brave, Tavily 或各大模型原生搜索偏广域搜索

    不太可能靠自己来增强结果的质量

  • Mr_Remon 楼主 08-16 00:53
    8

    这个的话确实,所以我写了多引擎路由,写明了什么条件下应当使用什么,并且适度放权给模型。并没有做类似于结果增强什么的,我是认为当前模型能够搜到足够合理的结果就已经很好了

  • 唯轩 08-16 05:50
    9

    佬,请问对比grok有什么优势,目前在用grok的搜索,感觉实时性和质量都很好,多agent质量会更好吗

* 帖子来源Linux.do
返回