1 / 12
文档名称:

praat客服语音标注.docx

格式:docx   大小:1,081KB   页数:12页
下载后只包含 1 个 DOCX 格式的文档,没有任何的图纸或源代码,查看文件列表

如果您已付费下载过本站文档,您可以点这里二次下载

分享

预览

praat客服语音标注.docx

上传人:2112770869 2018/12/1 文件大小:1.06 MB

下载得到文件列表

praat客服语音标注.docx

文档介绍

文档介绍:语音转写操作手册
(三层)
一、用脚本打开语音文件
1 点击praat—>open—>read from file—>找到你打开的文件—>打开—>选中同一个文件名的两个文件—>View & Edit;
2 Ctrl+2可以同时两层打点,Alt+Backspace可以删除时间点;
做完以后Ctrl+S 保存到根文件下面;
请参看培训视频。
二、开始标注语音文件
时间边界定位:
按Tab键可以播放语音,再次按Tab键/Esc键可以停止播放语音
按Ctrl+i可以放大波形;Ctrl+o可以缩小波形。建议放大1—2标注。
听音,在整段电话语音的基础上,根据语义和停顿时间等因素,在音频信号中每一句话的句首和句尾分别添加时间边界。
添加时间边界的方法为:将鼠标移动到语音波形的相应位置,这时会出现一条虚线以及圆圈,分别点击
SPEAKER层和CONTENT层对应的圆圈即可。或者直接Ctrl+2可以自动同时在SPEAKER层和CONTENT层打上时间点。在整个语音文件中,SPEAKER层和CONTENT层的时间边界的数目是完全一致的,每一对时间边界也是完全相等的。
请注意,SPEAKER层和CONTENT层的时间边界必须保持一致。也就是说不管点击哪一层的时间边界,另外一层一定是空心蓝色,而不是实心蓝色
文件标注:
GLOBAL层主要标注语音文件的一些全局信息,包括说话人性别信息和语种信息(方言区)。标注格式如下:
[speaker]:[空格]1[空格]性别,[空格]2[空格]性别;[空格][language]:[空格]1[空格]方言区,[空格]2[空格]方言区
例如:
[speaker]: 1 male, 2 female; [language]: 1 普通话, 2 普通话
[speaker]: 1 male, 2 male; [language]: 1 普通话, 2 普通话
[speaker]: 1 female, 2 female; [language]: 1 普通话, 2 普通话
[speaker]: 1 female, 2 male; [language]: 1 普通话, 2 普通话
SPEAKER层需要标注的是说话人信息,“说话人”取值为以下两种:1、2,分别表示说话人1、说话人2。(说话人1、2仅标注在文字段上,符号段不标注)
如果是客服类对话,则SPEAKER层的“说话人”取值为1的语音,必须是话务员;用户的语音取值为2
客服定义为奇数,用户为偶数;(客服一定是和用户有直接对话,否则不算客服)如果第三个人是用户的情况:
[speaker]: 1 female, 2 female, 4 female; [language]: 1 普通话, 2 普通话, 4 普通话
CONTENT层需要标注的是该句对应的文字,如果是汉语交谈,则只能用简体汉字。对于语音中的数字部分需根据发音情况转换为对应的汉字,例如“27”→“二十七”;“我的电话是2381832”→“我的电话是二三八幺八三二(与发音相同)”。
CONTENT层正常语音的标注
如果此语段为某一个人的汉语对话语音,请在SPEAKER和CONTENT标注时间边界,SPEAKER层标注1或者2,CONTENT层输入相应的文本。
如果此语段为两个人交叉语音,关于重叠(交叉)的语音,即对于某个人的一句话未完,另一个人的一句话已经开始的情况:请在SPEAKER层和CONTENT层标注时间边界,SPEAKER层不标注内容,CONTENT层标注“+”
对于叠加,必须是真实的。不能将大段的听不清语音和叠加混在一起。叠加段内的非叠加部分,前后最多不得超过1个字。至于由于添加叠加的时间边界导致的半个语音(即切掉头或者尾)可用
[*]或[UNK]来表示。[*]和[UNK]取决于是单段的听不清,还是在语音中听不清。
在整个语音中,需根据说话人的变换来增加时间边界。
如果同一说话人说话时间较长,则应根据其语义来增加时间边界,每个时间段的长度最多不能超过8s,但断句也不要太散太短。每个自然语言段平均在5-6秒左右即可。
每个时间边界的最佳位置在音频能量的最低点(即波谱图上黑色部分最淡的地方),如果仅有几个字包含不进来,那么建议舍弃这几个字
英文:(英文小写)
【单词】对于语音中简单的英文单词,在能听懂的情况下,直接标出即可。特殊符号用发音标注,不写特殊符号。例如:“”;
“”;(不要写@)
“请以井号键结束”;(不要写#)
【字母】每个字母中间用空格隔开。例如:good表示单词读音,g o o d则表示字母读音。例如:我的编号是f m s幺三二
如果发音是表示应答的“嗯”,统一都用“嗯”,不要用“恩”或者“厄”。其他的