巨额悬赏!!求助:如何在无规则的招标书中提取想要的信息段落

我才是鸟狙之神 2026-08-07 17:25 1

如何在无规则的招标书中提取想要的信息段落,并插入到标书模板中,并且语义通顺,向量化?还是?有偿求助!!

最新回复 (14)
  • nero1017 08-07 17:28
    1

    如何在无规则的招标书中提取想要的信息段落,并插入到标书模板中,并且语义通顺,向量化?还是



    就是构建知识库吧,RAG什么的。或者可以Coze + TextIn xParse,可零代码搭建招标文件解析机器人

  • Liberty 08-07 17:30
    2

    目前有一个项目,就是llm来做,比如我要招标金额,就是让llm 分段一段段看,然后最后把找到的证据在让llm判断一次哪个是金额。我们是内网部署的,只有64K的上下文

  • Rick_Su 08-07 17:31
    3

    提取好做,有关键词和语义匹配然后把上下文给大模型,然后结构化输出。填充的模板的话得构建agent,纯规则大概不行除非结构稳定 ^-^

  • HsiaoJo 08-07 17:36
    4

    看一下需要的信息段落是否可以明确分类,即明确的提取内容目标。



    1. 是否是原文

    2. 是否可以明确抽离出来 (例如废标项、招标金额、招标单位、采购需求…而不是某种采购产品局限于本招标书)

    3. ..


    插入到模板中:



    1. 模板是否是明确的已有涵盖内容的(区分框架待填充内容和已有类似内容需要内容适配替换)

    2. token消耗是否有限定

    3. 速度是否要特殊要求


    (暂时想到这么多,目前佬的这一小句话还是有点模糊)

  • 猫南北 08-07 18:04
    5

    所以楼主到底给多少钱呢? 还有有偿悬赏 可以挂 赏金任务 的tag

  • 我才是鸟狙之神 楼主 08-07 18:35
    6

    怎么搭建啊哥 这个机器人 知道工作流 但是具体的数据该怎么解析匹配替换呢,标书的上下文也比较庞大

  • 我才是鸟狙之神 楼主 08-07 18:36
    7

    不开玩笑哥,起步100 越具体价格越大 DDT0077 微信可详谈

  • 我才是鸟狙之神 楼主 08-07 18:37
    8

    可以提取出来这些,但是问题是你怎么插入到模板里面呢,都是语义化的,该怎么进行精准匹配呢?匹配完成后 又怎么确保匹配后是正确的 而不是幻觉,因为上下文很大

  • 我才是鸟狙之神 楼主 08-07 18:39
    9

    那就是让LLM查找然后另外一个agent做审查是吧,准确率高吗,标书的上下文蛮多的诶,我试了下感觉不太行啊,对提示词要求比较高,而且边界要约束的很到位

  • HsiaoJo 08-07 18:39
    10

    可以实现的,我们先聊需求,明确一下

  • 我才是鸟狙之神 楼主 08-07 18:40
    11

    替换呢哥,提取确实还可以,但是怎么替换呀

  • Liberty 08-07 18:40
    12

    标书各种奇奇怪怪的格式太多了,目前就是出现一个不准的让AI基于这个加规则,现在已经有很多层规则了,目前暂时稳定

  • 我才是鸟狙之神 楼主 08-07 19:28
    13

    这个规则能看看不佬,学习一下,要是让LLM一行行看的话,需要怎么约束呢

  • Liberty 08-08 00:53
    14

    出错了让 codex/claude code/opencode 这种agent直接用sota模型来指导应该怎么提取才对,都是AI写的,我几乎没看过。现在新的标书偶尔会有不对的,就让sota模型再来做一次

* 帖子来源Linux.do
返回