[开源] 基于 Edge TTS 的语音合成服务,兼容 OpenAI 音频接口

DejavuMoe 2026-09-26 03:38 1

项目地址: https://github.com/DejavuMoe/edgeTTS


这是一个用 Edge TTS 免费接口封装的语音合成服务


特性:



  • 协议兼容:支持 OpenAI 标准 /v1/audio/speech 格式,现有客户端改个 Base URL 即可使用

  • 长文本处理:内置分段切片与音频流拼接,解决长文本请求容易失败的问题

  • 支持声音映射与参数微调

  • Docker 镜像一键部署


image.webp

最新回复 (8)
  • rune15 09-26 06:55
    1楼
    很实用,已经用 docker 部署上了
  • gdm 09-26 07:47
    2楼
    真巧,昨天刚用 gemini 做了一个用 edge tts 做 txt 转 mp4 的 Python 脚本,我转 mp4 是因为拿来听一些比较难的东西
  • felixv 09-26 08:13
    3楼
    不错,已 start 。有没有可能实现一个多人对话的功能,可以设置一段文本的角色,并设置不同角色的音色,最终合成到一起。
  • lujiaosama 09-26 08:14
    4楼
    LZ 这个支持离线吗,这是我使用的最大痛点。生产环境是离线的又需要 TTS 真的麻烦。
  • DejavuMoe 楼主 09-26 10:39
    5楼
    @felixv 暂时不打算做,这个 API 可以指定不同的音色,然后自己在多人对话里流式调用应该就 Ok

    @gdm edge tts 做的还是可以的,最搞的是那个粤语、还有东北话很有意思哈哈哈

    @lujiaosama 不是离线场景的,TTS 是微软处理的
  • Hansah 09-26 23:06
    6楼
    edge 的质量太差了,我现在用的是 pocket-tts 和 kokoro 还有 supertonic ,基本都在 100M 这个级别
  • woodchen 09-27 03:23
    7楼
    先 star 了, 目前用的是 mimo 的免费 tts
  • iorilu 09-27 14:29
    8楼
    直接调微软服务不行吗, 为啥非要中转

    python 用 edgetts 包, 其他平台也有啊

    另外, 要离线用 kokoro

    其实声音差不多, 很明显, kokoro 就是那 edgetts 当训练材料做出来的
* 帖子来源V2EX
返回