[开源、文献阅读、科研佬快来]PaperQuay:一种新的文献阅读范式:瞬时跳转翻译、Agent管理文献、高亮批注导出、极低内存占用、兼容Zotero

Burr 2026-04-29 12:07 1

本帖使用社区开源推广,符合推广要求。我申明并遵循社区要求的以下内容:



  • 我的帖子已经打上 开源推广 标签:

  • 我的开源项目完整开源,无未开源部分:

  • 我的开源项目已链接认可 LINUX DO 社区:

  • 我帖子内的项目介绍,AI生成、润色内容部分已截图发出:

  • 以上选择我承诺是永久有效的,接受社区和佬友监督:


以下为项目介绍正文内容,AI生成、润色内容已使用截图方式发出


以下内容全手打!!!




PaperQuay 主要解决的问题


现有工具的痛点


科研体验方面




  • 翻译延迟打断心流:就我个人而言之前读论文遇到几个问题,当使用传统的翻译工具比如划词翻译的时候,往往因为api响应较慢所需时间较长,导致思考中断。




  • 对照翻译的弊端:我尝试过左右对照的那种翻译,比如左面是英文右侧是中文且保持格式不变,但是这个有两个问题:第一个是往往很难保持绝对的格式不变,第二个是左右来回扫视过一会就感觉专注不了




  • 纯中文阅读的局限:那为什么不只用纯翻译之后的中文文件呢?我觉得还是要学习原来论文的用词、排版,所以对于只用中文去读还是不太喜欢。




  • 无法速读论文:现在大量的速度都是把文献上传给比如GPT等大模型,让其生成一个大致的概述,但是如果有大量文献需要上传的过程过于繁琐,同时无法集中管理。比如我只关注论文的实验部分,这种方式无法实现速读




  • 性能问题: 有些软件当我打开大量的pdf时,内存占用很高,风扇呼呼转动,那能否制作一款较为轻量化的软件。




  • 费用太高: 很多软件无法自定义大模型api,只能使用内置的模型或者消耗高计费token。站里很多佬友分享的自建CPA、公益站等等低价甚至免费的资源用不上,




AI与Agent需求方面



  • 迎合AI趋势:现如今agent的概念不断发展,大家都开始寻求用AI阅读论文的方法,不少软件对于token收费较高且模型自定义能力较差,而且很多软件并没有Agent能力,比如如果要有大量文献需要管理分类,这个时候如果有Agent可以辅助,我觉得是很方便的。




关于 PaperQuay



在这个情况下制作了PaperQuay:它应用了一种新的翻译范式,对于每段原文提前翻译好(这个过程可以软件自动去做,或者挂机的时候去做),这样点击我要读的内容时,软件可以瞬间转到其翻译。而且借助Mineru可以很好地提取表格信息等等,方便和大模型交互。


同时集成了市面上大部分软件的批注、笔记能力,在此基础上可以划词直接加入笔记。对于原始pdf的编辑:可以通过PaperQuay进行论文高亮、插入文字、手写,并可导出批注后的pdf。同时内存占用极低。




PaperQuay 吸引我的点有什么




  1. 瞬间跳转翻译:它的即时翻译功能,只要提前解析好,可以实现瞬间跳转翻译。(同时具备主流的划词翻译功能)




  2. 批注管理跳转:可选择直接将划词内容加入笔记,方便修改。同时支持点击批注直接跳转对应文章区域




  3. 论文速读:可以在文献库右侧迅速看到自己想要的内容,包括但不限于背景、发现、实验设置、结论等等。




  4. 自定义大模型:自定义大模型api,可以自己选择api站点并接入。选择喜欢的大模型,注意这里的Mineru api申请应该是完全免费的,是github上的一个非常火的项目。




  5. agent能力:它的agent能力,通过agent方便分析、管理大量论文,包括但不限于命名、总结、分类(可以直接与软件交互)




  6. 内存占用极低:我个人的笔记本测试同时打开10篇论文和agent界面,内存占用基本为9.2MB(上下波动)




  7. 兼容Zotero:如果之前的大量文献都在Zotero进行管理的,可以在设置界面自动读取并导入,分类格式与zotero完全相同




  8. 未完待续:后续计划加入rag能力,方便自建知识库问答,同时支持一键生成综述(word、latex)等总结性文章。






PaperQuay界面展示


文献库界面





翻译跳转界面





划词翻译及笔记





Agent对话界面


这里以我希望为选中的几篇文献分类为例,Agent呼唤起特定的工具,且要求人为审批,界面也很好看(自吹自擂)





丰富的设置菜单





高亮与批注





Github链接




关于动态的使用图佬们可以看一下Readme,因为gif图太大了传不上来,然后对于全文翻译和Mineru解析佬们可以自己设置并发数,这样可以加快速度。


然后PaperQuay目前是支持windows、linux、mac系统,我自己在windows测试过两周,别的系统也欢迎佬友们测试,如果有问题联系我我尽快改。


以一篇NeurIPS论文为例,现在deepseek正在打折,用deepseek翻译一篇论文的价格应该是0.013左右。(感觉deepseek翻译文献很好用)





修复



  • 修复了自动概览勾选后重复生成问题

  • 应用了更严格的prompt进行mineru翻译

  • 修复了翻译后文档无法很好渲染公式问题




写在最后


从最早慕名始皇的Pandora入站以来真的和很多大佬学习了好多与人工智能有关的知识,希望这个项目能对有读论文、管理论文需求、希望从论文管理角度拥抱Agent的佬友们有所帮助。因为PaperQuay项目还并不完善,如果佬友们有使用问题欢迎在站内私信我!也很荣幸佬们点一颗star,谢谢大家!

最新回复 (19)
  • impouo 04-29 12:32
    1

    感谢佬友开源和分享。不过一眼看下去似乎没有太吸引我的点,如果我想提前翻译一版直接pdfmathtranslate翻译pdf,还可以输出双语对照格式,想批注啥的直接批注就行。想问下这个模式还有什么独特优势吗?

  • Burr 楼主 04-29 12:38
    2

    对的佬这个我在文中讲了 我自己使用pdfmathtranslate的时候发现比如有些格式会留空 不连贯 而且它自己部署有些难度 这个是第一点 这个软件只要自己接入api就可以很轻量化地翻译 而且比如可以一直读markdown内容 点击会 跳转到原文。


    然后就是现在的zotero其实也可以接入插件实现gpt问答,我就在想可不可以做一个内置的功能,因为zotero的插件太繁琐 很多新接触zotero的需要在网上找测评来判断哪个插件比较好来形成适合自己的体系。所以把agent管理 gpt问答 以及轻量化翻译这些需求结合到一起就制作了这个软件

  • Burr 楼主 04-29 12:41
    3

    然后就是结合我自己的使用体验来看 内存占用比较轻 而且可以通过agent自动进行分类 后续我还想接入比如生成综述 ppt之类的功能 这些只依托zotero开发插件难度很大 因为比如有格式问题 渲染问题 权限问题。如果从头做一个软件的话会比较容易集成 所以这个软件后续还有很多要做的地方 比如rag 综述 组会ppt等等 谢谢佬的疑问!

  • elefly 04-29 12:50
    4

    看起来很不错的一个客户端,先下载试用一下,感谢辛苦开发

  • Clow 04-29 12:54
    5

    俺之前就想做一个类似的应用来着,不过没有佬这么高的执行力

  • Burr 楼主 04-29 12:54
    6

    谢谢佬!现在项目初期可能还不太完善,如果有问题可以直接和我联系!

  • calendar 04-29 13:42
    7

    appimage 好像有问题,打开了以后是空白的,无法启动


    环境是 archlinux,本来想本地改一下,编译太久了

  • Burr 楼主 04-29 13:44
    8

    佬我排查一下试试,linux是github的tauri action自动编译的,我去借个电脑。。

  • Zephyr 04-29 14:04
    9

    下载简单试用了一下,感觉整体做的很不错 基础的功能还挺齐全的,用一段时间看看,期待佬进一步更新

  • Burr 楼主 04-29 14:13
    10

    archlinux



    佬的电脑是arm设备吗我刚才在amd64的ubuntu试了一下deb那个能运行,佬界面提示啥呀

  • calendar 04-29 14:31
    11

    不知 arm,deb 在 arch 上用不了,我用的是 appimage。

    没有提示,就是一片空白

  • 星幻灵 04-29 14:36
    12

    目前大概试用了一下,整体功能都还不错,不过个人有有些问题;

    一是在设置好api接口进行全文翻译时,用的一个公益站,但结果一个翻译块的内容都没有,但在公益站日志中有看到调用成功了,正常都是输入几百token,输出1,2千token,但有个别输出超过6万token的,不知道软件在翻译过程中出现了什么问题;后来换了一个公益站能正常翻译;这中间的翻译过程不知道要怎么优化一下;还有就是不知道能不能限制一下每分钟调用api接口的次数,现在很多公益站有这些要求。

    二是minerU解析后的文档里面有时有些识别错误,特别是段内的一些公式,这个之后能手动修正一下吗?再就是翻译之后,结构化阅读这个区域是不是就只有翻译后的版本,不能切换到原来英文的版本(原来英文的版本只能在pdf阅读里看到)

  • Burr 楼主 04-29 15:02
    13

    佬这个翻译是取的json,和模型能力有一定关系,我测试是用gpt5.4mini(cpa逆向)这类的模型能基本百分百正常格式,deepseek(官方)这类的也可以,调用api接口的次数可以在设置里面设置并发,默认的话是一次一次发就是收到上个回复再接着发,然后最大可以设置同时发送8个请求 佬如果是用的比如能力相对弱一些的模型的话:可以把段落的每次发送块数调低,这样模型相对来说好区分


    第二个是mineru这个段内公式有部分是markdown渲染的问题 我之前也遇到过就是有的文章能够很好地渲染 有的还是保留latex代码 我感觉可能和mineru的返回格式有关系 我打算这几天优化一版,谢谢佬的建议!

  • Burr 楼主 04-29 15:03
    14

    收到 佬稍等我下载个虚拟机试一下 感谢反馈呀

  • 星幻灵 04-29 15:13
    15

    我2次用的都是gemini-3-flash-preview,只不过是用的公益站不同,感觉和发送块数关系不大,如果能有些日志之类的记录一下调用情况就能更好的知道是什么问题了。有可能确实跟每分钟调用api接口的次数有关。

    麻烦了,就期待之后的优化更新了。

  • Burr 楼主 04-29 15:16
    16

    日志在调试的时候会有。。但是release版本看不到 要是gemini 3的话毕竟模型很强 感觉应该确实是返回json处理的问题, 谢谢佬的建议!后续我把json格式再优化一下,看看有没有什么更严格的方法啥的

  • Burr 楼主 04-29 15:17
    17

    佬可以试试用deepseek这类的 现在官网降价了感觉还挺方便

  • 星幻灵 04-29 15:20
    18

    以后有机会再试试deepseek,现在用gemini比较多

  • Torpedo 04-29 15:21
    19

    感觉翻译直接用flash类模型实时选中翻译的话,也不会很慢呀,但是软件里带的数据清洗我还挺感兴趣的,最近在做类似的事,学习一下。另外说一句配色挺好看的

* 帖子来源Linux.do
返回