Pi官方提醒:禁用你的 pi-observational-memory 插件

sallyn 2026-09-21 01:03 1

今日 Pi发布0.86版本 提示这是一次比较重要的更新




在稍后官方X发布了一条推文 提示 pi-observational-memory 这个插件存在BUG 会导致Pi频繁崩溃 建议在上游修复之前禁用





本次更新有两个比较重要的更新 可以考虑更新一下你的 settings.json 文件



提示词缓存预热 — 在耗时较长的工具运行期间,以及可选择在空闲时,通过兼顾成本的刷新机制保持高价值提示词缓存的活跃状态。请参阅“缓存预热”。





关于这个新的缓存预热

提供商在一段时间不活动后会丢弃提示缓存条目,因此暂停后的首次请求需要再次支付完整的输入费用。缓存预热会在过期前不久以单 token 的输出预算重新发送上一次请求:



  • "off" 禁用预热。

  • "streaming" 在长时间工具执行期间保护开销较大的前缀,并在代理稳定后立即停止。

  • "idle" 还会在等待你的下一条提示时考虑刷新,使用根据实际使用情况测得的固定 15% 延续概率。


{
"cacheWarming": "idle"
}


只有在预期的避免缓存未命中成本减去刷新成本后仍至少带来 0.05 美元的预期节省时,才会发送刷新。活动智能体运行使用 100% 的延续概率。/session 显示下一个决策、延续概率、预期节省、阈值和估算成本。启用缓存未命中通知时,每次成功刷新都会连同其成本显示在记录中;通知会标明扩展覆盖。


当上下文发生变化(模型切换、压缩、分支导航)时,预热会停止。空闲预热最迟在最后一次真实提供商请求后 30 分钟停止;活动智能体运行期间的预热在 60 分钟后停止。扩展可以通过 cache_warming_decision 事件覆盖每个决策。


每次刷新都按完整上下文的缓存读取加上一个输出令牌计费。使用量和成本会出现在会话总计中,但绝不会进入模型上下文。Pi 会在缓存生命周期的 90% 处调度候选,同时留出至少十秒直到过期。


预热需要知道模型的缓存生命周期以及请求所使用的保留层级(short,或在 PI_CACHE_RETENTION=long 时为 long)。内置目录包含直接使用 Anthropic 时的生命周期;自定义模型和其他提供商可以在 models.json 中通过 promptCache 声明自己的生命周期(请参阅 提示缓存生命周期)。在思考开启时,使用基于预算而非自适应思考的 Claude 模型会被跳过,因为 Anthropic 会从 max_tokens 推导思考预算并据此生成消息缓存键,因此单 token 请求无法复现该条目。




分模型压缩预算 — 按模型配置保留和近期标记(token)预算。请参阅“分模型替换覆盖”。


最新回复 (1)
  • ipi 09-21 01:30
    1

    早先就发现了,就这个插件跟我其他插件各种冲突,就离谱

* 帖子来源Linux.do
返回