语音与音频库
发现优质的语音与音频库工具,基于用户评价、使用数据与活跃度综合排序。
9
款产品
热门推荐 9 款

Kaldi
Kaldi 是语音识别领域经典的工具包,本仓库为其官方代码仓库
6 语音与音频库
2

whisper.cpp
免费OpenAI Whisper 语音识别模型的 C/C++ 移植实现,可在本地高效运行
6 语音与音频库
3

PocketSphinx
面向参考文档的静态站点生成器,使用 reStructuredText
5 语音与音频库
4

Whisper
免费Whisper 是 OpenAI 推出、基于大规模弱监督学习的鲁棒语音识别模型
5 语音与音频库
5

Bark
免费基于文本提示的生成式音频模型,可根据文字描述直接合成自然语音与音效。
5 语音与音频库
6

VALL-E
免费非官方的音频语言模型VALL-E的PyTorch实现,支持语音合成与音频生成。
5 语音与音频库
7

DeepSpeech
免费Mozilla 开发的离线语音识别引擎,采用深度学习模型
4 语音与音频库
8

FireRedTTS
免费一个开源、由大语言模型驱动的TTS基础系统,赋能高质量语音合成。
3 语音与音频库
9

EnCodec
免费Meta 开发的神经音频压缩器/分词器,是 AudioCraft 的核心组件
语音与音频库
已显示全部 9 款