free-spoken-digit-dataset:免费的语音数字音频数据集。 将MNIST视为音频-源码

上传者: 42102220 | 上传时间: 2021-10-07 19:23:06 | 文件大小: 15.66MB | 文件类型: -
免费口语数据集(FSDD) 一个简单的音频/语音数据集,由8kHz的wav文件中的口头录音组成。 修整录音,使其在开始和结束时几乎保持静音。 FSDD是一个开放的数据集,这意味着它将随着时间的推移随着数据的添加而增长。 为了实现可重复性和准确的引用,使用Zenodo DOI和git tags对数据集进行版本控制。 当前状态 6位演讲者 3,000个录音(每个扬声器每个数字50个) 英语发音 组织 文件以以下格式命名: {digitLabel}_{speakerName}_{index}.wav示例: 7_jackson_32.wav 会费 请贡献您的自制录音。 所有录音应为单声道8kHz wav文件,并进行修剪以使静音降至最低。 不要忘记使用发言人元数据更新metadata.py 要添加数据,请按照acquire_data/say_numbers_prompt.py的记录说明进行a

文件下载

评论信息

免责申明

【只为小站】的资源来自网友分享,仅供学习研究,请务必在下载后24小时内给予删除,不得用于其他任何用途,否则后果自负。基于互联网的特殊性,【只为小站】 无法对用户传输的作品、信息、内容的权属或合法性、合规性、真实性、科学性、完整权、有效性等进行实质审查;无论 【只为小站】 经营者是否已进行审查,用户均应自行承担因其传输的作品、信息、内容而可能或已经产生的侵权或权属纠纷等法律责任。
本站所有资源不代表本站的观点或立场,基于网友分享,根据中国法律《信息网络传播权保护条例》第二十二条之规定,若资源存在侵权或相关问题请联系本站客服人员,zhiweidada#qq.com,请把#换成@,本站将给予最大的支持与配合,做到及时反馈和处理。关于更多版权及免责申明参见 版权及免责申明