[发明专利]将中英混合及语气标签化的数据标注方法及装置有效
申请号: | 201911404092.9 | 申请日: | 2019-12-31 |
公开(公告)号: | CN111145719B | 公开(公告)日: | 2022-04-05 |
发明(设计)人: | 戴健;周伟东;刘华;刘凯;喻凌 | 申请(专利权)人: | 北京太极华保科技股份有限公司 |
主分类号: | G10L13/02 | 分类号: | G10L13/02;G10L13/033;G10L15/06;G10L15/26;G10L25/30 |
代理公司: | 北京艾格律诗专利代理有限公司 11924 | 代理人: | 王子溟 |
地址: | 102200 北*** | 国省代码: | 北京;11 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本申请实施例公开了一种应用在深度学习语音合成算法中的,将中英混合及语气标签化的数据标注方法及装置,所述方法包括:从数据源中抓取训练文本,所述训练文本涵盖有中英文字符;为所抓取的所述训练文本添加情感标签,记录发音人根据情感标签标注后的训练文本的朗读音频文件,作为训练用音频文件;核检训练用音频文件与对应的训练文本的情感标签是否一致,不一致的部分对音频文件进行修订;将训练文本映射为文本向量,将文本向量及发音人的朗读音频文件,提交给神经网络的深度学习引擎进行训练,通过深度学习训练,学习中文、英文、情感标签的各种组合搭配下的文本的发音特点。 | ||
搜索关键词: | 将中英 混合 语气 标签 数据 标注 方法 装置 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于北京太极华保科技股份有限公司,未经北京太极华保科技股份有限公司许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/201911404092.9/,转载请声明来源钻瓜专利网。
- 上一篇:一种变电站自动化设备故障判断方法
- 下一篇:金属标准品的制备方法