【data6】__espnetdataset.py__2021-05-13

1.继承父类dataset

主要功能:对数据进行包装


数据包装

2.是否用数据增强的手段,加载字符对ID的词典

加载json文件

json文件位置没有找到!用speech里的加载


代码


json数据格式

以及各种数据的数据特征名称



3.一些变量的描述

utt_id

说话人和说话语句的id


代码


infos

json文件里面储存的信息


大字典里面套小字典

path

返回的是路径

语音路径


input

input是一个list

input[0]


input[0]是一个dict

path = infos['input'][0]['feat']

调用字典中的列表中的一个字典

{'feat': '/home/ktxu/workspace/project/End2EndASR/egs/aishell/dump/dev/deltafalse/feats.1.ark:34775', 'name': 'input1', 'shape': [432, 80]}

path



/home/ktxu/workspace/project/End2EndASR/egs/aishell/dump/dev/deltafalse/feats.1.ark:34775

feature

是一个元组(不可修改)



feature

转化为张量,(注意此处有警告张量不可写)

数据的特征

4.是否用数据增强


代码

targets

字符



返回对应的ID和字符的长度

target在输入的时候是数字的形式

5.返回语句的长度

6.输出每一条语句对应的特征维度(第一条语句432维)


第一条语句


7.找出字符对应的id(已测试)


©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成,浏览时请结合常识与多方信息审慎甄别。
平台声明:文章内容(如有图片或视频亦包括在内)由作者上传并发布,文章内容仅代表作者本人观点,简书系信息发布平台,仅提供信息存储服务。

相关阅读更多精彩内容

友情链接更多精彩内容