我有大批量音频转录的txt需要转成标准MD,现在进度太慢了,佬们有什么建议吗

jimygo 2026-06-19 18:17 1

大概还剩下7万个,还是借着各位佬们分享的mimo的key一天蹬出来5万个,不过现在额度都蹬的差不多了,佬们有啥好建议没。我之前问codex,它说embedding完就行,错字、断句不准啥的没啥影响,过2天再问又建议我全转标准MD,说这样噪音更少,现在搞完一小半,不上不下的,挺难受 ^-^

最新回复 (12)
  • Enze 06-19 18:25
    1

    这个需求小模型应该就够了?租GPU跑?

  • jimygo 楼主 06-19 18:27
    2

    我本机跑过,在B站找的qwen的向量模型,跑出来不尽人意,还不如原文稿…

  • 钟阮 06-19 18:34
    3

    买点gpt-5.4-mini,或者看看glm-4-flash[免费]/deepseek-4-flash吧

  • jimygo 楼主 06-19 18:35
    4

    我突然想起来智谱还送了我token,我赶紧去看看过期没

  • lueluelue 06-19 18:36
    5

    有例子吗?想看一下(如果可以)


    很多 LLMs 跑的时候都会出一些问题,比如说某些句子,它给你重新写一遍同义句,或者吞字,这个几乎只有 gpt 能保证原样复述


    Grok 的 composer 或许能跑,不过他幻觉相对高

  • oswald522 06-19 18:41
    6

    为啥是向量模型,不应该是语音模型,阿里百炼平台有免费的语音模型额度,qwen ASR猛猛用。

  • jimygo 楼主 06-19 18:43
    7

    小模型跑的那些吗?那是一周前了,因为质量不行所以模型都已经删了,我用过硅基流动的模型,也是不行,便宜大碗的就是mimo,我自己的也被蹬完了

  • jimygo 楼主 06-19 18:45
    8

    我用funsasr转录完了,速度可以,质量其实也不错,但我怕agent调用的时候会因为错别字和断句错误误导。向量模型其实具体我也不懂,AI帮我的,大意就是根据语义去搜索相关的素材

  • 06-19 18:46
    9

    推荐小米的mimo,要有这个模型的权限MiMo-V2.5-Pro-UltraSpeed,可以搜一下站内其他佬申请内容教程,MiMo-V2.5-Pro-UltraSpeed速度贼快, 1000 TPS

  • jimygo 楼主 06-19 18:48
    10

    是的,但我的mimo额度已经完事了,现在在让codex接入GLM的试试

  • 06-19 18:52
    11

    QoderWork CN有Qwen3.7免费的一些额度,也可以减轻一些负担吧,可以去试试

  • jimygo 楼主 06-19 18:55
    12

    谢谢,我这就去看看。codex测试GML4.5AIR还行,但没有mimo贴原文

* 帖子来源Linux.do
返回