[发明专利]一种科技文本命名实体识别方法在审
申请号: | 202011244352.3 | 申请日: | 2020-11-10 |
公开(公告)号: | CN112395879A | 公开(公告)日: | 2021-02-23 |
发明(设计)人: | 李国徽;潘鹏;周思远;徐志鹏;邱启弘;钟芳郅;袁凌 | 申请(专利权)人: | 华中科技大学 |
主分类号: | G06F40/295 | 分类号: | G06F40/295;G06N3/04 |
代理公司: | 华中科技大学专利中心 42201 | 代理人: | 尹丽媛;李智 |
地址: | 430074 湖北*** | 国省代码: | 湖北;42 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明属于文本关键信息抽取领域,具体为一种科技文本命名实体识别方法,包括:采用实体识别标注模型对目标领域科技文本进行实体识别标注;其中该模型训练方法为:将目标领域的标注样本和源领域的部分样本输入源领域标注模型,分别得到目标领域和源领域的深层特征向量,计算该两个向量间的MMD;基于MMD调整源领域标注模型参数;采用新的源领域标注模型为目标领域每个未标注样本预测伪标签,将目标领域的标注样本和带伪标签的样本按比例混合并输入新的源领域标注模型,再次计算MMD,重复上述直至MMD最小,得到实体识别标注模型。本发明是面向多领域、多范围文本的基于迁移学习的命名实体识别,有效解决深度学习对特定领域少量数据学习能力不足的问题。 | ||
搜索关键词: | 一种 科技 文本 命名 实体 识别 方法 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于华中科技大学,未经华中科技大学许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202011244352.3/,转载请声明来源钻瓜专利网。