求助帖,关于自动翻译api

lerry 2026-06-07 01:28 1

就是我公司因为做的是海外游戏板块,然后员工需要翻译,现在我们的软件自带翻译是带了个1.8g的大模型,在本地运行,但是偶尔会卡死,还有翻译不准确,怎么样,我能做一个api,我直接对接到软件上,这样,软件也不大了,免费的或者微付费,但是并发很高,佬们有啥好意见吗



就是一个DC聚合软件 我们公司自己做的 但是里面的翻译是在员工电脑本地运行要4G左右的运存 他们会同时聊很多天 都要翻译 所以并发会很高

最新回复 (17)
  • 晓看天色 06-07 01:31
    1

    可以用一下站内的deeplex的api?

  • 550W 06-07 01:31
    2

    并发高的话自己部署就不太可能了

    要翻译质量硅基流动或者其他提供的qwen3-next-80b可以考虑一下……

    不要质量那就hy-1.5的直接上的了

    而且1.8G的模型翻译会很烂?(鞭打一下那个练模型的)

  • Eevee 06-07 01:32
    3

    据说混元那个小模型的翻译能力还不错。


    免费的渠道有很多。汇总几个的话,并发一下似乎不是不可能。

  • Vrans 06-07 01:33
    4

    直接用大模型的API就好了,能力强、并发高、翻译业务也不贵,本地部署的模型一般没硬件的话都很拉,除非你的业务要求翻译实时性很高那只能边缘部署了

  • lerry 楼主 06-07 01:35
    5

    是的可以调用API但是这个费用太高了,确实承担不起

  • Demorain 06-07 01:39
    6

    要效果还能微调保持术语考虑 QwenMT

    要速度还是Qwen MT

    不要钱没辙



    这个不错,哈雷都说好,我是在沉浸式翻译里用还行,不过听说限制并发(或者试试美团那个美团longcat挺多tokens免费)

  • lerry 楼主 06-07 01:41
    7

    如果买一个性能好点的服务器 然后自己搭建一个好一点的大模型 搞成API 可以吗

  • Demorain 06-07 01:45
    8

    啊?那你要租gpu吗?应该比较贵吧?想自己跑除非用amd那个ai cpu或者mac的m系列,或者是老黄新出的cpu才能跑得动,租一个性能高的服务器如果自费要亏死吧


    (主要是特定cpu搭配大内存就可以载入更高参数量的开源模型,否则就是没办法,而且比较好的翻译模型还是别人自己训练的,我看有日语模型就是它们自己练galgame、日文轻小说等等才效果不错)

  • 午时 06-07 01:45
    9

    现在可以低价买些gpt team的bug号,并发翻译,我就差不多翻译了100万danbooru的tag

  • lerry 楼主 06-07 01:46
    10

    我这种并发太高了,100多个人使用软件,一个软件上300个dc账户,哪怕一个人一天翻译100条,就是1万条,上收费的api实在肉疼

  • GILMORE 06-07 01:47
    11

    不追求速度的话,可以用我的那个,试试看效果。

  • lerry 楼主 06-07 01:47
    12

    比如一天1万条正常对话,一天下来要多少啊

  • Vrans 06-07 01:47
    13

    说实话,感觉租服务器更贵,你可以先算一下租服务器的价格曲线和调api的价格曲线,要是服务器价格能承担 然后也能搭一个不错的模型 那就服务器

  • Aelura 06-07 01:48
    14

    GLM-4.7-Flash免费可以到20并发,实际体验下来小任务还可以,翻译可以试试看

  • lerry 楼主 06-07 01:48
    15

    你那个是完全免费的吗,我刚才看到你的帖子了

  • lerry 楼主 06-07 01:50
    16

    都是正常的小对话,不会太长的,关键,用的人多,而且是同时使用,

  • Demorain 06-07 01:56
    17

    我现在不太清楚什么参数量的翻译专用模型适合你的需求和翻译质量,但是比如说假设不错的翻译模型要20b也就是差不多一次就要载入20多gb到gpu显存或者内存里。


    然后如果你要给100多个人,这个并发量要满足的话,肯定得也要载入差不多100多条parallel才行吧100*20=2000GB(不过说得有点满了,如果不是同一时间是100多人用的话,少一些应该也行),只能是租ai cpu+大内存的组合,而且还不止一台服务器才行,这开销太高了说不定还不如用收费api


    我感觉用翻译专用的模型好一些,看看有没有什么api,像我刚刚提到的Qwen MT就是只是用来翻译的、不带chat,可能用这种会省一些tokens?猜的,佬可以多试试看不同模型

* 帖子来源Linux.do
返回