Murf
音频音乐将脚本生成旁白,并通过声音、发音和节奏控制调整表达。Murf Studio 面向内容制作,Murf 的 API、配音与对话智能体产品则处理不同流程。
将脚本生成旁白,并通过声音、发音和节奏控制调整表达。Murf Studio 面向内容制作,Murf 的 API、配音与对话智能体产品则处理不同流程。
通过文字转语音和可调播放速度收听书面资料。Speechify 将朗读与付费扫描、摘要及语音功能结合,Studio 和 API 则属于需分别了解的产品。
基于 Transformers.js 与 Whisper 模型的免费浏览器语音识别应用,支持文件、音频链接和录音输入,在设备端推理,并提供文本与 JSON 导出。适合短录音整理及浏览器 AI 原型探索。
开源语音克隆系统,将参考录音的音色与生成语音结合,支持多语言与风格控制工作流。V1、V2 采用 MIT 许可,可自行部署;适合使用本人或已获授权声音的创作者、开发者与研究人员。
在浏览器中进行语音清理、播客录制与转录编辑,提供长期免费计划。免费 Enhance Speech 每天可处理 1 小时音频,但单文件时长、大小以及视频和批量能力有明确限制。
为兼容的 Audacity 安装增加本地 AI 降噪、音乐分轨、语音转录、音乐生成和音频增强功能,适合希望在多轨编辑器内完成处理的用户。
可本地部署的语音合成项目,提供参考声音、情感、发音和语速控制;使用需遵守 bilibili 专门的模型协议。
面向中英文对话语音研究的生成模型,可控制说话人特征与表达;公开模型限非商业教育和研究用途,不能当作免费商用配音引擎。
免费开源的语音识别工具箱,可组合转写、语音活动检测、标点和说话人处理,并提供本地推理及服务部署路径。
可免费自行部署的语音生成模型与工具,支持参考声音、多语种合成、指令控制,以及 Python 和流式服务集成路径。
可免费自行部署的语音合成工具,提供浏览器界面、参考声音合成、可选微调,以及切片、转写和文本校对等数据准备功能。
用于语音均衡、降噪、响度控制与成品输出的 AI 音频后期服务,每月提供 2 小时免费处理,免费成果包含 Auphonic 提示音。