单窗口5000轮会话不丢上下文,是不是骗子?

长生落丶 2026-09-06 15:39 1

如题,抖音刷到那个什么硅基拍档的SKILL,但是找不到仓库,作者也找不到,就很奇怪,但是他的视频里面讲的5000轮会话还能记住上下文,真能做到吗?有巨佬解答一下原理吗?

最新回复 (9)
  • hucccl 09-06 15:40
    1

    多怀疑他人在怀疑自己然后多测试

  • 长生落丶 楼主 09-06 15:50
    2

    主要没找到仓库,没办法验证,自己本地跑,基本上超过50轮很多时候就管不住了啊

  • xiedian 09-06 15:52
    3

    虽说没有调查就没有发言权是对的。但这个5000对话能记住上下文还用验证吗?^-^太假了点,肯定还有其他限定

  • 长生落丶 楼主 09-06 15:59
    4

    所以就想问有没有大佬有这玩意,我自己本地测测

  • Abruzz1 09-06 16:03
    5

    真要说起来也没难度啊。在不谈token的前提下我把上下文存成md放仓库里,让llm按时间顺序慢慢搜不就得了。只不过收益和token消耗不成正比。现在普遍做法是有损压缩+向量索引,不丢上下文是不存在的。

  • 长生落丶 楼主 09-06 16:07
    6

    如果会话和索引文件越来越大,理论上只要机器的内存和磁盘的读写能支持,就能无限扩?

  • Abruzz1 09-06 16:08
    7

    不存在无限上下文。只有一种情况是你按需检索,你想要哪份上下文,给他搜出来。不是说所有上下文都放在message history里。

  • UESTC 09-06 16:09
    8

    确实,如果不说时间、效率、成本、可用性,就是耍流氓

  • Abruzz1 09-06 16:10
    9

    pi那个创始人说的AIagent不需要memory,这句话其实挺对的。你可以理解一下这句话。compaction>memory

* 帖子来源Linux.do
返回