求助科研佬和智能体大佬:有关使用cc/codex对pdf翻译

walor 2026-06-17 23:57 1

最近在整理我的收藏的文档,其中包含了一些英文版本pdf,我现在想用cc或者codex对pdf进行翻译,但是效果不好,主要是排版的问题。

我能想到可以优化的方案,但是不知道效果会不会好,特来求助一下大佬,不知道大佬的方案如何。



  1. 存在使用cc/codex直接对话就可以有一份效果很好的pdf译版本:prompt是什么?

  2. 使用了插件?他人提供的mcp?可否提供方案?

  3. 有没有skill可以复用?

  4. 效果都不行?参考开源项目可否?pdf2zh等等这些项目

  5. web版本能解决?




后面如果要对paper或书籍翻译是否类似操作?




有别的agent?

(之前都是通过web端让ai帮我翻译在对话框)

最新回复 (6)
  • BigYanger 06-18 00:08
    1

    可以看看这个大佬的skill,我试了效果不错,就是有点费token

    shttps://linux.do/t/topic/2409217?u=bigyanger

  • otion21 06-18 00:10
    2

    個人體感下來因為處理pdf 的場景不同,並非哪個skill就能滿足你的需求,最佳解還是你先和agent交互直到滿意的產出,再請它把整個流程寫成客製化的skill。

  • 麻子脸 06-18 00:20
    3

    记得宝玉大神提到过一个思路,说用两个 agent,第一个尽量贴近直译,让第二个给第一个打分并且反馈意见,这样反复来达到最好的效果

  • 胡不归 06-18 00:39
    5

    保留排版的话用PDFMathTranslate, 之前站里找的项目; 直接拆成plain text也能接受的话, 直接用paddle的那一堆layout工具拆好, 然后用一个VLM based的OCR模型提取文本, 最后让agent翻译, 或是再套一个翻译模型就行了

  • walor 楼主 06-18 01:06
    6

    这个不行,他做的是识别结构,提取内容然后翻译成md,并没有排版成pdf

  • walor 楼主 06-18 01:09
    7

    那得自己干点活了,还是得自己东西配置然后写点东西,我寻思可以套用个插件或者skill啥的,通过prompt一句话让agent工作

* 帖子来源Linux.do
返回