LimitRateAPI,避免 429

adrianzhang 2026-06-20 14:06 1

由于很多大模型 API 有 requests per second 这类请求速率限制,因此 vibe coding 了一个小代理,设置好模型的 rpm ,它会帮你管理请求,太快的,就排队,这样就不会触发 429 错误。

用的 Python ,应该可以在 Linux/MacOS/Windows 上运行使用。

Open Source repo:
https://github.com/adrianzhang/LimitRateAPI

缘由:
使用 Hermes+免费 API ,很频繁遇到 429 ,一个小事情做着做着就断了,非常烦人。有了这个代理,Hermes 可以顺畅运行了。

这是我第一个 vibe coding 项目,希望能帮助有同样需求的人。代码是 GLM5.2 写的,如果有问题,去喷智谱:)
最新回复 (4)
  • slowman 06-20 14:29
    1
    等待,还不如手动 fallback 到其他可用后端
  • adrianzhang 楼主 06-20 14:31
    2
    @slowman 好主意。但是只有几个免费 API 的时候就经常把全部 API 都超了。Hermes 这类 agent 经常大量发请求。
  • getadoggie 06-20 19:02
    3
    hermes 不会自动重试吗
  • adrianzhang 楼主 06-20 19:42
    4
    @getadoggie 不会呀,至少我用的时候不会,它只会 fallback ,还是我设置了它才能。
* 帖子来源V2EX
返回