{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,3,27]],"date-time":"2025-03-27T12:05:23Z","timestamp":1743077123263,"version":"3.40.3"},"publisher-location":"Berlin, Heidelberg","reference-count":15,"publisher":"Springer Berlin Heidelberg","isbn-type":[{"type":"print","value":"9783642244339"},{"type":"electronic","value":"9783642244346"}],"license":[{"start":{"date-parts":[[2011,1,1]],"date-time":"2011-01-01T00:00:00Z","timestamp":1293840000000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2011]]},"DOI":"10.1007\/978-3-642-24434-6_21","type":"book-chapter","created":{"date-parts":[[2011,10,5]],"date-time":"2011-10-05T23:40:43Z","timestamp":1317858043000},"page":"265-272","source":"Crossref","is-referenced-by-count":3,"title":["Automatic Web Information Extraction Based on Rules"],"prefix":"10.1007","author":[{"given":"Fanghuai","family":"Hu","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Tong","family":"Ruan","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zhiqing","family":"Shao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jun","family":"Ding","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","reference":[{"key":"21_CR1","volume-title":"Mining the Web: Discovering Knowledge from Hypertext Data","author":"S. Chakrabarti","year":"2002","unstructured":"Chakrabarti, S.: Mining the Web: Discovering Knowledge from Hypertext Data. Morgan Kaufmann, San Francisco (2002)"},{"key":"21_CR2","doi-asserted-by":"publisher","first-page":"93","DOI":"10.1023\/A:1010022931168","volume":"4","author":"I. Muslea","year":"2001","unstructured":"Muslea, I., Minton, S., Knoblock, C.: Hierarchical Wrapper Induction for Semistructured Information Sources. J. Auton. Agent. Multi-Ag.\u00a04, 93\u2013114 (2001)","journal-title":"J. Auton. Agent. Multi-Ag."},{"key":"21_CR3","doi-asserted-by":"publisher","first-page":"265","DOI":"10.1007\/978-0-387-35614-3_16","volume-title":"IFIP Working Conference on Engineering Information Systems in the Internet Context","author":"A. Pan","year":"2002","unstructured":"Pan, A., Raposo, J., Alvarez, M., Hidalgo, J., Vina, A.: Semi-Automatic Wrapper Generation for Commercial Web Sources. In: IFIP Working Conference on Engineering Information Systems in the Internet Context, pp. 265\u2013283. Kluwer Academic Publishers, Norwell (2002)"},{"key":"21_CR4","doi-asserted-by":"publisher","first-page":"1411","DOI":"10.1109\/TKDE.2006.152","volume":"18","author":"C.H. Chang","year":"2006","unstructured":"Chang, C.H., Kayed, M., Girgis, M.R., Shaalan, K.: A Survey of Web Information Extraction Systems. J. IEEE T. Knowl. Data En.\u00a018, 1411\u20131428 (2006)","journal-title":"J. IEEE T. Knowl. Data En."},{"key":"21_CR5","doi-asserted-by":"publisher","first-page":"8492","DOI":"10.1016\/j.eswa.2010.05.027","volume":"37","author":"X.W. Ji","year":"2010","unstructured":"Ji, X.W., Zeng, J.P., Shang, S.Y., Wu, C.R.: Tag Tree Template for Web Information and Schema Extraction. J. Expert Syst. Appl.\u00a037, 8492\u20138498 (2010)","journal-title":"J. Expert Syst. Appl."},{"key":"21_CR6","doi-asserted-by":"publisher","first-page":"731","DOI":"10.1145\/1017460.1017462","volume":"51","author":"V. Crescenzi","year":"2004","unstructured":"Crescenzi, V., Mecca, G.: Automatic Information Extraction from Large Websites. J. ACM\u00a051, 731\u2013779 (2004)","journal-title":"J. ACM"},{"key":"21_CR7","first-page":"313","volume-title":"Proceedings of the 3rd International Conference on Web Information Systems Engineering","author":"J.Y. Wang","year":"2002","unstructured":"Wang, J.Y., Lochovsky, F.H.: Data-Rich Section Extraction from HTML Pages. In: Proceedings of the 3rd International Conference on Web Information Systems Engineering, pp. 313\u2013322. IEEE Computer Soc., Los Alamitos (2002)"},{"key":"21_CR8","volume-title":"Proceedings of the 8th ACM SIGKDD International Conference on Knowledge Discovery and Data Mining","author":"S.H. Lin","year":"2002","unstructured":"Lin, S.H., Ho, J.M.: Discovering Informative Content Blocks from Web Documents. In: Proceedings of the 8th ACM SIGKDD International Conference on Knowledge Discovery and Data Mining. ACM, New York (2002)"},{"key":"21_CR9","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"219","DOI":"10.1007\/978-3-642-04409-0_25","volume-title":"Web Information Systems Engineering - WISE 2009","author":"S. Mengel","year":"2009","unstructured":"Mengel, S., Jing, Y.: Extracting Structured Data from Web Pages with Maximum Entropy Segmental Markov Model. In: Vossen, G., Long, D.D.E., Yu, J.X. (eds.) WISE 2009. LNCS, vol.\u00a05802, pp. 219\u2013226. Springer, Heidelberg (2009)"},{"key":"21_CR10","first-page":"23","volume-title":"19th International Workshop on Database and Expert Systems Application","author":"T. Weninger","year":"2008","unstructured":"Weninger, T., Hsu, W.H.: Text Extraction from the Web via Text-to-Tag Ratio. In: 19th International Workshop on Database and Expert Systems Application, pp. 23\u201328. IEEE Computer Soc., Los Alamitos (2008)"},{"key":"21_CR11","unstructured":"Document Object Model, \n                    \n                      http:\/\/www.w3.org\/DOM\/"},{"issue":"5","key":"21_CR12","doi-asserted-by":"publisher","first-page":"513","DOI":"10.1016\/0306-4573(88)90021-0","volume":"24","author":"G. Salton","year":"1988","unstructured":"Salton, G., Buckley, C.: Term-Weighting Approaches in Automatic Text Retrieval. J. Inf. Process. Manag.\u00a024(5), 513\u2013523 (1988)","journal-title":"J. Inf. Process. Manag."},{"key":"21_CR13","volume-title":"Proceedings of the 16th Conference on Computational Linguistics","author":"R. Grishman","year":"1996","unstructured":"Grishman, R., Sundheim, B.: Message Understanding Conference 6: A Brief History. In: Proceedings of the 16th Conference on Computational Linguistics. Association for Computational Linguistics, Stroudsburg (1996)"},{"key":"21_CR14","unstructured":"MUC-7 Information Extraction Task Definition, \n                    \n                      http:\/\/www-nlpir.nist.gov\/related_projects\/muc\/proceedings\/ie_task.html"},{"key":"21_CR15","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"4","DOI":"10.1007\/BFb0026666","volume-title":"Machine Learning: ECML-98","author":"D.D. Lewis","year":"1998","unstructured":"Lewis, D.D.: Naive (Bayes) at Forty: The Independence Assumption in Information Retrieval. In: N\u00e9dellec, C., Rouveirol, C. (eds.) ECML 1998. LNCS, vol.\u00a01398, pp. 4\u201315. Springer, Heidelberg (1998)"}],"container-title":["Lecture Notes in Computer Science","Web Information System Engineering \u2013 WISE 2011"],"original-title":[],"link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-642-24434-6_21","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,4,9]],"date-time":"2019-04-09T23:35:09Z","timestamp":1554852909000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-642-24434-6_21"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2011]]},"ISBN":["9783642244339","9783642244346"],"references-count":15,"URL":"https:\/\/doi.org\/10.1007\/978-3-642-24434-6_21","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2011]]}}}