CPAMP新功能,tibo玩不起了

💪 🎯 🚀 ☁️ 2026-09-20 10:18 1

RT 48team的gpt6给路由到了luna


之前就怀疑降智,画出来这玩意

最新回复 (15)
  • viento 09-20 10:24
    1

    是的,发送的token数量在3000以内,100%触发

  • ychell 09-20 10:26
    2

    计费还是按照astra的,这就是降智最恶心的地方

  • alizoed 09-20 10:31
    3

    这个是默认会打开的功能吗,我这不知道为什么没显示,还是说只有返回模型不一致的时候才会提示?



    刚刚升级到最新然后试了下发现好像没有

  • gptman 09-20 10:35
    4

    • Request Monitoring 的模型列现在区分请求模型、路由模型和上游响应模型;当响应模型与路由模型不一致时,以琥珀色响应模型与“模型不一致”标记提示异常路由结果。(Web / Manager Server)

      看更新日志,只有不一样的时候才会显示

  • ECE2 09-20 10:37
    5

    已更新, 炸裂, 发现我的 astra 都是 luna ^-^

  • saqjs-ld 09-20 10:41
    6

    好家伙,路由到 sol 就算了,没想到是 luna??

  • seakee 09-20 11:24
    7

    太不厚道了,都路由到 luna 了,TPS 还这么低 ^-^

  • wren 09-20 11:29
    8

    用astra 是路由到luna, 但是我开luna max 就 capacity 真TM无语

  • 兰克 福 09-20 11:40
    9

    一直用luna max,没有什么异常啊

  • seakee 09-20 11:44
    10

    感觉最近有一段时间了,luna 又慢又蠢,执行已经切换 3.8f 了

  • 兰克 福 09-20 11:45
    11



    感觉很快啊

  • 兰克 福 09-20 11:45
    12

    3.8f不敢用,经常把我项目改坏

  • luckxingkj 09-20 11:48
    13

    还有这功能??cpa怎么知道实际模型是什么。

  • seakee 09-20 11:48
    14

    我看你开的是快速,这个速度和之前的普通输出是差不多的,我现在普通的输出 tps 最高不超过 20

  • XDE 09-20 11:49
    15

    为啥你的首字这么短,我在dmitpro上面部署的cpa,结果首字每次都一二十秒

* 帖子来源Linux.do
返回