不同服务器上调用Nvidia免费api成功率区别挺大的

Royo 2026-06-10 00:13 1

我在两台服务器上部署了newapi,调用nvidia的免费api(https://build.nvidia.com/)

主要测试调用deepseek v4 pro,ds比较热门。


^-^ 一台是美东的dedirock,1H2G小弱鸡,cogent->4837线路,延迟250ms~300ms,大部分时间调用ds v4 pro是失败的;其他模型整体测试成功率也不如下面这台skyline的。



dedirock这台小鸡的ip质量:



^-^ 下面这一台是小鬼子家的skyline,1H1G小弱鸡,软银->4837,延迟70ms~100ms,大部分时间可成功调用。



skyline这台小鸡的ip质量:




  • 注:这两张newapi界面不同,是因为一个是新版界面、一个是旧版界面,newapi版本都是v1.0.0-rc.10。实测切换新旧界面不影响结果。


按说即便所属地区不同,调用的也是nvidia同一个算力池。但明显小鬼子家延迟低这台小鸡实际调用成功率更高。


我能想到的区别:



  • 所属区域:美东 / 小鬼子家

  • ip质量:skyline会更好些

  • 延迟:也是skyline更好


不知道是哪些因素导致的skyline这台小鸡调用成功率更高。

小白不懂具体原因,把结果贴出来给佬们参考。。。

最新回复 (4)
  • 最喜欢阿罗娜和普拉娜酱了 06-10 00:18
    1

    可能是恰好时间点的问题,nvidia的api就有时候只会卡顿3分钟左右就又变流畅了

  • Royo 楼主 06-10 00:21
    2

    恰好时间点的问题,nvid



    我连着三天不同时段测试了,最开始我以为是dedirock上newapi版本旧的问题,更新后再测试依然是这个结果。整体上skyline这台服务器调用成功率就比较高,尤其是ds v4 pro模型。

  • sun shaoan 06-10 00:38
    3

    免费的能用吗?,我都闲置了,毫无体验可言

  • 干啥啥不行 06-10 00:41
    4

    冷门的模型倒是挺快的,但是体验真的一言难尽

* 帖子来源Linux.do
返回