[发明专利]基于语义的信息采集方法及系统在审
| 申请号: | 201310452655.8 | 申请日: | 2013-09-27 |
| 公开(公告)号: | CN103473369A | 公开(公告)日: | 2013-12-25 |
| 发明(设计)人: | 李涓子;祁羽;何巍;焦程波;张鹏;杨瑞兵 | 申请(专利权)人: | 清华大学 |
| 主分类号: | G06F17/30 | 分类号: | G06F17/30 |
| 代理公司: | 北京路浩知识产权代理有限公司 11002 | 代理人: | 李相雨 |
| 地址: | 100084 北京市海*** | 国省代码: | 北京;11 |
| 权利要求书: | 查看更多 | 说明书: | 查看更多 |
| 摘要: | 本发明涉及数据挖掘技术领域,具体涉及一种基于语义的信息采集方法及系统。该信息采集方法包括步骤:S1.根据网络资源的典型特征,建立网络资源抽象数据模型;S2.借助搜索引擎从互联网采集网络信息,并将采集的网络信息用所述网络资源抽象数据模型进行格式化处理;S3.对格式化处理后的网络信息进行聚类分析,并根据聚类分析结果将所述网络信息划分入对应的话题中,并提取每个话题的标签;S4.对所述步骤S3中处理结果进行可视化展示。本发明由话题驱动进行网络资源组织、可视化展示以及对网络资源的下载和离线查看,从而可以多维度的对网络信息进行展现,以形象、直观的方式将网络信息呈现给用户,实现了提高用户浏览效率的效果。 | ||
| 搜索关键词: | 基于 语义 信息 采集 方法 系统 | ||
【主权项】:
一种基于语义的信息采集方法,其特征在于,包括步骤:S1.根据网络资源的典型特征,建立网络资源抽象数据模型;S2.借助搜索引擎从互联网采集网络信息,并将采集的网络信息用所述网络资源抽象数据模型进行格式化处理;S3.对格式化处理后的网络信息进行聚类分析,并根据聚类分析结果将所述网络信息划分入对应的话题中,并提取每个话题的标签;S4.对所述步骤S3中处理结果进行可视化展示。
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于清华大学,未经清华大学许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/201310452655.8/,转载请声明来源钻瓜专利网。
- 信息记录介质、信息记录方法、信息记录设备、信息再现方法和信息再现设备
- 信息记录装置、信息记录方法、信息记录介质、信息复制装置和信息复制方法
- 信息记录装置、信息再现装置、信息记录方法、信息再现方法、信息记录程序、信息再现程序、以及信息记录介质
- 信息记录装置、信息再现装置、信息记录方法、信息再现方法、信息记录程序、信息再现程序、以及信息记录介质
- 信息记录设备、信息重放设备、信息记录方法、信息重放方法、以及信息记录介质
- 信息存储介质、信息记录方法、信息重放方法、信息记录设备、以及信息重放设备
- 信息存储介质、信息记录方法、信息回放方法、信息记录设备和信息回放设备
- 信息记录介质、信息记录方法、信息记录装置、信息再现方法和信息再现装置
- 信息终端,信息终端的信息呈现方法和信息呈现程序
- 信息创建、信息发送方法及信息创建、信息发送装置





