期刊文献+

Java XML与面向Web的智能数据抽取 被引量:8

Intelligence Data Extraction Based on Java XML and Web
下载PDF
导出
摘要 采用标准Web技术———HTML,XML和Java,开发一种基于Web用Java把Web数据转换为XML的数据挖掘方法.该方法标识数据源并把它映射成XHTML,根据一定的相关关系查找数据内的引用点并进行智能数据抽取,将数据映射成XML.这种数据抽取方法比较简单,通过选择可靠的数据源以及在这些数据源中选取与内容相关但与格式无关的锚点,可以较为方便地建立一个强壮的数据抽取系统. A method for web-based data mining is developed using the standard technologies of the web--HTML,XML, and Java. convert existing web pages into XML with XML. The data extraction method is very simple only by selecting some reliable data resources and anchor-points which are dependent on those data resources and content of web pages, but independent of the form of web pages.
作者 文艺 刘循
出处 《四川大学学报(自然科学版)》 CAS CSCD 北大核心 2004年第2期315-318,共4页 Journal of Sichuan University(Natural Science Edition)
关键词 XML XEITML XSL 数据抽取 XML XHTML XSL data extraction
  • 相关文献

参考文献1

  • 1HarjinderS Gll(美)著 王仲谋 刘书舟译.数据仓库-客户/服务器计算指南[M].北京:清华大学出版社,1997..

共引文献1

同被引文献43

引证文献8

二级引证文献8

相关作者

内容加载中请稍等...

相关机构

内容加载中请稍等...

相关主题

内容加载中请稍等...

浏览历史

内容加载中请稍等...
;
使用帮助 返回顶部