[分享创造] 我做了一个「会说话的 AI 写作伙伴」:语音口述 → 人设声色自定义 → diff 采纳,从一句话到一本书

DanZai233 2026-08-09 16:13 1

做这个项目的起因很简单:家里长辈想写自传,打开文档不知道怎么开头;我自己写小说也经常卡在「怎么把脑子里那点碎片变成段落」。市面上的 AI 写作工具大多是「生成器」——丢个关键词出来一大段,但真正创作的人需要的是陪伴、引导、反馈,而不是替代。


于是有了 Aicho Muse · 声创


核心工作流



  1. 语音或打字说出想法(语音用浏览器原生 STT ,不用配密钥)

  2. AI 以「人设」身份提问、引导、给反馈——不是一次生成完,而是一步步陪你理清

  3. 当你确定方向,AI 进入写作模式,只输出正文

  4. 回复以 diff 形式标出可采纳的新内容,用户决定采纳/忽略/写入哪个章节——AI 永远不会悄悄改你的稿子


创作结构



  • 书 → 章节 → 封面,完整作品结构,不只是一堆 Markdown

  • 大纲 / 人物卡 / 时间线 / 灵感箱 / 角色关系图(力导向图 + AI 生成候选关系)

  • 版本历史、离线草稿、导出 MD / PDF / DOCX


人设与声色



  • 人设字段:性格、说话风格、价值观、口头禅、擅长领域、开场白,全部注入提示词

  • AI 可一键生成或润色人设

  • 音色:Fish Audio 音频广场搜索/试听/收藏( 83 种语言),也支持克隆自己的声音

  • 管理后台可配 TTS/STT Key


协作



  • 邀请码协作,多人同时编辑,实时光标定位(位置刷新间隔做长了,服务器压力可控)


技术栈



  • 前端 React 18 + TS + Vite + Tailwind ,移动端已适配

  • 后端 Node.js + Express ,MySQL 8 ( Docker Compose 一键部署)

  • AI 通过 UniLLM SDK 接入 14+ 厂商( OpenAI / Claude / Gemini / DeepSeek / 通义 / 豆包 / Kimi / Ollama 等),当前线上用 deepseek-v4-flash

  • 管理后台:数据概览 / 用户管理 / 预设管理 / 管理员


部署docker compose up --build -d 一条命令,自带 MySQL ;不配 AI Key 也有内置规则引擎可用。


线上演示:muse.danzaii.cn (可注册体验)


欢迎 Star 、试用、拍砖。有什么想加的功能直接说,我还在持续迭代。

最新回复 (2)
  • bao626 08-09 20:55
    1
    👍
  • goojia 08-09 23:56
    2
    在手机端上,发送按钮被反馈意见的信封挡住了
    https://picui.ogmua.cn/s1/2026/08/09/6a78a257e3434.webp
* 帖子来源V2EX
返回