每个工具都标注国内可用、中文支持、价格区间,按场景与需求筛选。
开源AI语音工作室,支持语音克隆、听写和创作
将文本转为多角色配音脚本,支持编辑讨论
一款语音转文字并智能润色的AI听写工具,帮你高效整理口头想法。
在 iPhone 上将文字转为自然逼真的 AI 配音,支持多种语音风格。
在浏览器中使用的AI鼓机,模拟经典MPC功能,创作电子音乐节拍。
Tapfree for Chrome 是一款浏览器扩展,通过语音听写将你说的话实时转为文字,并智能适配当前屏幕内容。
预测语音AI性能的音频洞察工具,帮助优化语音识别等应用
TaskGPT 是一款 MacOS 上的语音智能助手,通过语音交互帮助用户完成任务和管理日程。
ControlFoley 利用 AI 控制生成电影级拟音音效,为视频内容自动匹配环境声与动作声。
Orchestria 是一款 AI 音乐引擎,支持对音乐音轨进行精细控制与编辑。
Stable Audio 3 是 Stability AI 推出的音频生成工具,可根据文本描述生成高质量音乐和音效。
多维视界是一款AI音频工具,可智能处理音频编辑、转换与增强。
轻析LiteSight是一款AI音频分析工具,可快速提取并分析音频内容。
Keevx声音克隆是一款AI语音合成工具,可快速克隆任意声音并生成自然语音。
Vemus未音是一款AI音频工具,可生成音乐、音效和语音,助力内容创作。
Audio Flamingo Next 是一款音频处理工具,支持语音识别与合成。
Voxtral TTS 是一款高质量文本转语音工具,支持多种语言和自然发音。
TurboScribe 是一款 AI 驱动的音频转文字工具,支持多语言高精度转录。
讯飞译制是AI音频翻译与配音工具,支持多语种视频音频转写和合成。
Lyra 2.0 是一款 AI 驱动的语音合成工具,可生成自然逼真的语音。
Gemini 3.1 Flash TTS 是谷歌推出的文本转语音工具,支持快速生成自然语音。
逗哥配音是一款AI音频工具,支持文字转语音、语音克隆和多种音色选择,适合短视频配音和有声内容创作。
PrismAudio 是一款 AI 音频处理工具,可分离人声、乐器并提升音质。
Grok的语音模式,支持快速思考和实时对话。