详细信息
文献类型:期刊文献
中文题名:Web结构挖掘算法探讨
英文题名:Improved Algorithms for Web Structure Mining
作者:宋建康[1];张礼平[1]
机构:[1]华东理工大学信息科学与工程学院,上海200237
年份:2003
卷号:29
期号:5
起止页码:537
中文期刊名:华东理工大学学报(自然科学版)
外文期刊名:Journal of East China University of Science and Technology
收录:CSTPCD;;国家哲学社会科学学术期刊数据库;Scopus;北大核心:【北大核心2000】;CSCD:【CSCD2011_2012】;
语种:中文
中文关键词:Web结构挖掘;HITS;XML;Hub;权威页面
外文关键词:Web structure mining; HITS; XML; Hub; authority page
摘要:在分析Web结构挖掘现有算法的基础上,重点研究了HITS(Hyperlink-InducedTopicSearch)算法。Hub页面的多主题性、无关页面和无关链接等对于HITS算法有较大影响。针对这些问题,提出了HITS算法的改进算法。
This paper focused on HITS(HyperlinkInduced Topic Search) algorithms analyzing after some research on other Web structure mining algorithms. Much factors including multisubjects of Hub pages、irrelevant pages and irrelevant links have effects on HITS' performance. To resolve those problems, we propose an improved algorithm on HITS.
参考文献:
正在载入数据...
