如何在Python中安装speech_data库及处理安装报错问题
问题原因
speech_data并非公开上传到PyPI的第三方标准库,所以你无法通过常规的pip安装方式获取该库,也搜不到官方站点。它是你所用示例作业配套的自定义本地工具模块,仅在作业的完整源码包中提供。
解决步骤
- 优先查找你这份示例作业的完整配套资源,找到其中命名为
speech_data.py的文件,将该文件放到你当前运行代码的同级目录下,即可直接import调用,示例中的batch = word_batch = speech_data.mfcc_batch_generator(64)代码可直接运行。 - 如果找不到配套的
speech_data.py文件,可以自行实现对应功能,你用到的mfcc_batch_generator方法核心为读取语音数据集、提取MFCC特征、按指定batch size输出,实现逻辑如下:- 先安装依赖库:
pip install librosa numpy scipy - 新建本地
speech_data.py文件,写入对应功能代码,核心逻辑包含:- 遍历本地语音数据集路径,读取所有音频文件与对应标签
- 对每个音频调用librosa的mfcc接口提取特征,做长度统一对齐
- 按输入的batch size参数循环输出特征batch和对应标签batch
- 先安装依赖库:
- 完成上述操作后重新运行代码即可解决报错。
报错截图参考

内容的提问来源于stack exchange,提问作者Manish
相关产品推荐
相关产品推荐

