【技术求助帖】pdf识别准确率和速度问题

ricksanchezzz12301 2026-08-17 16:05 1

有大量商品介绍pdf,一个几百页几百上千页,在 4h8g服务器上vibecoding了一个简单的网站用来识别分类价格商品信息等等,用的是PaddleOCR+云端识别方案也有Schema校验层,但是识别准确率和图片映射还是堪忧,有佬有相关经验吗,想请教一下,为了速度我用的是 4 并发小模型gpt4o来识别

最新回复 (6)
  • nice-L 08-17 16:06
    1

    还不如截图用gpt5.5进行识别呢,成功率很高亲测过

  • ricksanchezzz12301 楼主 08-17 16:09
    2

    我想的是有没有专用api,5.5 模型成本可能太高了

  • ricksanchezzz12301 楼主 08-17 16:10
    3

    还有就是有没有其他的技术方案来解决这个问题,这个主要是用到生产端所以正确率和速度都要有

  • nice-L 08-17 16:13
    4

    之前尝试过很多方案但是都不理想可能也是pdf结构比较复杂导致的,最后还是走gpt5.5了,最省事也是效果最好的,基本上都能识别到,就是成本高一点但是没办法(三色图)

  • skating 08-17 17:09
    5

    有没有示例来几份呢?截几个你比较常见的场景看看

  • Mrzzj 08-17 17:13
    6

    可以先将pdf转为图片,然后使用qwen系列的flash模型直接识图,这个模型很便宜,效果也还可以。

    我之前就试过用这个路径去识别论文pdf原文的作者相关信息

* 帖子来源Linux.do
返回