按分类浏览

AI 音频工具

语音合成、音乐生成、转录与音频处理工具

32 个资源

选型指南

如何选择AI 音频工具资源

AI 音频工具大致分两条线,一条是语音合成与克隆,做播客、配音、数字人配音;另一条是转录与降噪,服务会议和内容团队。合成类要看声音的自然度和情感表现,克隆类还得确认授权范围——未经本人同意克隆声音是有法律风险的。转录类的核心指标是准确率和多语言支持,中文识别效果得单独实测。

选择时重点核对

  • 合成与克隆场景先拿自己的文本试听,情感和停顿处理比音色更影响可用性
  • 声音克隆前确认平台的授权流程,避免侵犯他人声音权
  • 转录类工具拿真实录音测准确率,会议室噪音和口音会明显拉低效果

适合哪些用户

  • 做播客与视频配音的创作者
  • 需要会议记录和转录的职场团队
  • 开发语音交互产品的技术人员

工具目录

AI 音频工具资源

浏览全部分类
Fish Audio新收录

语音合成与声音克隆平台,支持 30 多种语言

Cartesia新收录

低延迟语音合成与识别,在第三方语音竞技场排第一

Riffusion 改名后的 AI 音乐生成,底座换成 Lyria 与 Veo

LALAL.AI新收录

音轨分离工具,能拆出人声、鼓、贝斯等分轨,按分钟数一次性买断。

Notta新收录

日本团队做的语音转文字与会议纪要工具,免费档每月 120 分钟。

Superwhisper新收录

Mac、Windows 与 iOS 上的语音输入工具,支持离线识别,通过 SOC 2 Type II 认证。

Typecast新收录

AI 配音与声音克隆平台,API 免费档每月 15000 积分。

Mureka新收录

AI 音乐生成,从文字提示出整首歌含人声和歌词,年付每月 8 美元起。

Beatoven.ai新收录

为视频、播客和游戏生成免版税背景音乐的 AI 作曲工具。

为创作者和开发人员提供噪声消除产品

一种人工智能数字语音解决方案

一款人工智能降噪工具

多功能 AI 语音生成器

一个自动转录、翻译和字幕平台

AI 驱动的音频录制和编辑

一个开源的自动语音识别系统,经过68万小时的多语言和多任务监督数据训练

一个人工智能创作情感配乐音乐

一款人工智能驱动的文本转语音工具

一款音视频内容AI,可以根据视频和音频文件对其进行自动分类、摘要和提取

一个文本转语音的工具

一个使用深度伪造技术生成不同语言和声音的文本到语音的音频剪辑的工具

人工智能生成音乐

一家语音识别、自然语言理解和文本到语音技术领域的全球领导者

以客户为导向的语音助手

一套用于构建和集成Azure认知服务语音服务功能到应用程序中的工具

让您的播客更具临场感

NaturalReader新收录

AI 语音朗读,覆盖在线、移动端、商用授权与教育版

Speechify新收录

文本转语音,用自然 AI 声音朗读文档、PDF、网页和电子书

Vocal Remover新收录

免费在线人声分离与分轨,几秒生成卡拉 OK 伴奏