【分享】带着我的deepseek-v4-flash-vision-rag去参加企业家RAG挑战赛 - 不小心拿了第一名!

liangdabiao 2026-08-30 08:54 1

上周在linuxdo社区发布了我的新rag skill:


最近在社区发布了3个基于deepseek-v4-flash-vision 视觉deepseek理解 的开源skill项目:

佬友评论说,怀疑和有问题。所以我完整测试一次看看行不行:
1 我先找一本扫描版的lego图书,这种其实一般都很难用常规方法进行rag,最难搞的进行测试:
[image]
几百页的图文图书,让deepseek先理解,然后索引好知识和数据:
[image]



佬友是怀疑态度,那么我试试:带着我的deepseek-v4-flash-vision-rag去参加企业家RAG挑战赛 ,看看它是不是真的能打!


挑战赛选择了这个:





里面的pdf例子:



deepseek-v4-flash-vision-rag 挑战结果:







具体方案:


核心解决方案:三段式检索(复用技能):本地 TF-IDF 粗筛 → 视觉精排 → 带邻页深读






索引的样子:






成绩很好!


我的deepseek-v4-flash-vision-rag 是通用的RAG, 我相信什么类型的rag任务,都能够搞定! 而且利用了 deepseek-v4-flash-vision 又便宜又好,我查看一下账单,没有几块钱就搞定!


开源不容易,感谢佬友反馈和支持

最新回复 (5)
  • Grogu 08-30 08:57
    1

    佬友太强了 ^-^,前排学习一下 ^-^

  • DonQ 08-30 08:59
    2

    太强了,我来学习一下,果然 L 站是能学到东西的

  • 🛡️Rice R. Rug 💛🍋⭐️💫 08-30 09:02
    3

    恭喜恭喜,这个比赛第一名有奖金吗

  • cash7 08-30 09:20
    4

    太强大了,正好仔细学习。 对于日常工作中文本+图片+文件 综合 RAG, 我的理解图片和文件可以借用这种方式实现,抛弃了 LightRAG 或者 GraphRAG 这种三方组件;那么

    文本RAG 佬友是如何考虑的,是否可以将三者综合起来RAG

  • Shigure_init 08-30 09:38
    5

    感觉和LangChain 和 MemGPT记忆系统差不多…就是把记忆的对象从会话改成了书籍

* 帖子来源Linux.do
返回