Murf
音频音乐将脚本生成旁白,并通过声音、发音和节奏控制调整表达。Murf Studio 面向内容制作,Murf 的 API、配音与对话智能体产品则处理不同流程。
可免费自行部署的语音合成工具,提供浏览器界面、参考声音合成、可选微调,以及切片、转写和文本校对等数据准备功能。
GPT-SoVITS 把语音合成和可选声音模型微调组织为浏览器工作流,官方仓库介绍了跨语种合成,以及音频切片、转写和标签校对等准备工具。它更适合愿意配置环境的创作者与研究者,安装软件并不会自动提供所有模型、硬件和可用录音。
起步时建议先准备一段有权使用的清晰录音,尝试参考声音推理,再决定是否需要专门整理微调数据。声音相似不等于文稿准确,生成结果仍可能错读名字、漏字或出现不自然衔接,需要同时核对内容与听感。
制作自己的旁白初稿
准备多语种样例
整理微调数据
比较模型版本变化
官方图片,可点击放大查看。

确定安装路径
准备授权录音
生成短篇样本
审核并保存
示例提示或操作任务:使用我已授权的参考录音合成这段教程开场,保持提供文字不变,生成后逐项核对人名、数字、停顿和句尾是否正确。
这是编辑建议的评估任务,本站查看了官方界面和资料,没有进行音质测量或训练声音模型。
开源不代表在线演示无限使用,模型与配套组件的条件也需要分别确认。
MIT 许可的软件提供免费自部署路径,项目也链接了可下载模型。硬件、电力、存储以及租用 GPU 的费用另算,具体使用的权重和辅助组件仍应分别检查条件。
在线演示便于理解界面,但存在容量和额度限制,不能当作无限免费生产服务。即使软件不收订阅费,微调所需录音准备、标注和结果审核也会占用时间,应纳入实际成本。
软件采用 MIT 并可自行部署,硬件和额外服务另算。
有参考音频推理路径,可以先试短样本再决定是否微调。
当前仓库列出中文、英语、日语、韩语和粤语。
不是,当前界面明确提到额度限制及备用空间。
需要,错误标签会进入准备流程,应对照录音修正。
不应直接混用,要匹配代际、配置和界面版本。
应使用有适当处理和发布权限的录音与声音。
平台、输入输出、开源许可和使用条件,完整保留在这里。
仓库提供 Windows、Linux 和 macOS 相关安装方式,各自有设备注意事项。推理与训练要求不同,能生成一段短语音不代表同一配置适合更大的训练任务,选择前应按当前版本说明判断。
典型输入包括参考音频、必要时的参考文本、目标文稿和语言设置,输出是合成音频,训练流程还会生成模型文件。建议建立稿件、模型版本、设置和输出文件的简单对应记录,便于之后修订。
所需资源准备齐全后,本地推理可以在自己的设备处理;托管演示则会接收上传录音。应根据材料性质选择运行环境,不从软件名称推断数据一定留在本地。
软件许可不会自动授予模仿他人或再使用录音的权利,声音授权和内容权利应与技术配置分别处理,不将合成语音冒充为他人的真实表态。
正在加载使用体验…
收藏仅自己可见。评论通过审核后公开,修改后会重新审核;评论数量包含获准公开的评论和回复。每人一份评分,新评分自动批准,撤回、未获批准或失效的评分不计入总分。请分享真实体验,避免垃圾信息、私人信息或人身攻击。
审核申诉或数据处理问题: support@findgoodai.com
带上一个真实任务,看看它是否适合你的工作方式。
使用体验